常用的医学科研统计方法有:计量资料的统计方法可分为参数检验法和非参数检验法。参数检验法主要为t检验和方差分析(ANOVN,即F检验)等,两组间均数比较时常用t检验和u检验,两组以上均数比较时常用方差分析;非参数检验法主要包括秩和检验等。t检验可分为单组设计资料的t检验、配对设计资料的;方差分析可用于两个以上样本均数的比较,应用该方法时,要求各个样本是相互独立的随机样本,各样本来自正态总体且各处理组总体方差齐性
科学研究很早就已经从简单的定性分析深入到细致的定量分析,科研工作者要面对大量的数据分析问题,科研数据的统计分析结果直接影响着论文的结果分析。在医学科研写作中,实验设计的方法直接决定了数据采取何种统计学方法,因为每种统计方法都要求数据满足一定的前提和假定,所以论文在实验设计的时候,就要考虑到以后将采取哪种数据统计方法更可靠。医学统计方法的错误千差万别,其中最主要的就是统计方法和实验设计不符,造成数据统计结果不可靠。下面,医刊汇编译列举一些常见的可以避免的问题和错误:打开百度APP,查看更多高清图片一、数据统计分析方法使用错误或不当。医学论文中,最常见的此类错误就是实验设计是多组研究,需要对数据使用方差分析的时候,而作者都采用了两样本的均数检验。二、统计方法阐述不清楚。在同一篇医学论文中,不同数据要采取不同统计处理方法,这就需要作者清楚地描述出每个统计值采用的是何种统计学方法,但在许多使用一种以上数据统计分析方法的医学论文中,作者往往只是简单地把论文采用的数据统计方法进行了整体罗列,并没有对每个数据结果分析分别交代具体的统计方法,这就很难让读者确认某一具体结果作者到底采用的是何种数据分析方法。三、统计表和统计图缺失或者重复。统计表或者统计图可以直观地让读者了解统计结果。一个好的统计表或统计图应该具有独立性,即作者即使不看文章内容,也可从统计表或统计图中推断出正确的实验结果。而一些医学论文只是简单地堆砌了大量的统计数字,缺乏直观的统计图或表;或者虽然也列出了统计表或统计图,但表或图内缺项很多,让读者难以从中提取太多有用的信息。另外,也有作者为了增加文章篇幅,同时列出统计表和统计图,造成不必要的浪费和重复。统计表的优点是详细,便于分析研究各类问题。统计图(尤其是条形统计图)的优点是能够直观反映变量的数量差异。医学论文中对数据统计结果的解释,最常见的两个错误就是过度信赖P值(结果可信程度的一个递减指标)和回避阴性结果。前一个错误的原因是因为一些作者对P值含义理解有误,把数据的统计学意义和研究的临床意义混淆。所以医学研究人员一定要注意不能单纯依靠统计值武断地得出一些结论,一定要把统计结果和临床实践结合在一起,这样才会避免出现类似的错误。至于回避阴性结果,只提供阳性结果,是因为不少作者在研究设计时,难以摆脱的一种单向的思维定式就是主观地先认定自己所预想的某种结果结论。在归纳某种结果原因时,从一个方向的实验就下完美的结论,尤其是如果这个结论可能对实际情形非常有意义时。这样的思维定势过于强调统计差异的显著性,有时会刻意回避报道差异的不显著结果,不思考和探究差异不显著的原因和意义,反而会因此忽视一些重大的科学发现。
一般常用的统计检验方法有:t 检验、卡方检验、方差分析和相关回归分析。统计检验方法的选择主要依据数据的类型(计量、计数) 、组数的多少(两组、多组) 、样本量的大小以及对比的方式(相互比较、配对比较) ,此外计量数据还要考虑分布形态和方差齐性等问题。
秋风送爽,也给我们送来了刘岭教授的统计说说第五期。这一期的统计学方法之选择大家一定要认真学起来,说不定马上你就会用到了。编者语针对常用的基本统计学方法,一般而言说的就是t检验、单因素方差分析和卡方检验,这也是大家在写论文、阅读论文时经常遇到的统计学方法(几乎每篇文章都会涉及这一种或几种方法),那到底该采用何种统计学方法呢?今天我们就此来聊聊。一、拿到数据开始分析之前,一定要进行数据类型的划分(图1),因为不同数据类型资料,描述的方式不一样,统计学方法也不一样。图1 统计资料的类型举个例子(表1):表1 某地2002年735例65岁以上老年人健康检查记录二、各种类型资料的统计分析(描述与统计推断)1.计量资料特点:每个观察单位的观察值之间有量的区别,有单位;描述形式:最常见采用“X±S”(一般文献中经常见到),用算数均数描述其平均水平,用标准差描述其离散程度。如果遇到数据“特别变态”(特别是标准差大于算数均数),就采用Md(P25,P75)(Md为中位数,P25和P75为四分位数)(表2)。正态分布检验请大家复习:医学科研课堂丨统计说说(三):你所应该了解的正态、方差齐性检验表2 计量资料常用统计指标的特点及其应用场合统计推断方法:一般分为单因素和多因素两种。单因素分析方法分析要点:一是划清数据类型(计量资料);二是明确试验设计类型(完全随机设计?几组样本?);三是注意所用方法的应用条件;四是满足正态方差齐性时采用t检验(注意t检验有三种形式哦!)或单因素方差分析,不满足时采用秩和检验(图2)。图2 计量资料统计方法的正确选择提醒两点:① 如果样本数据不服从正态分布的话,那就只能用非参数检验(秩和检验),但其检验效能低于参数检验(t检验或方差分析)。所谓检验效能低就是本身有差异,却没有能力发现其差异。② 如果是两组以上样本的数据时,不能采用t检验(会导致假阳性错误概率增加),应该采用方差分析。若方差分析的P<,需再进一步两两比较,常用的方法为LSD法或SNK法(注意依旧不能采用t检验)。在上两讲内容中我们已经学过t检验(医学科研课堂丨统计说说(二):你的t检验做对了吗?)和方差分析(医学科研课堂丨统计说说(四):统计学方法之灵魂—方差分析)了,至于秩和检验,我们以后会逐步介绍滴。多因素分析一般采用回归分析,主要是线性回归分析,以后会给大家介绍此方法。2.计数资料特点:无序分类,同类别中各观察单位之间没有量的差别,但各类别间有质的不同,各类别互不相容。其中二分类一定是计数资料(例如性别只有男/女之分,是否继发某种疾病只有继发/未继发之分),而多分类满足分类在性质上没有程度等级上的差别,即为计数资料(例如婚姻状况包括未婚、已婚、离异、丧偶,就属于多分类,但各分类没有程度等级差别,因此为计数资料,尿糖定性检测结果包括-、+、++、+++、++++,属于具有程度等级差别的多分类资料,就不属于计数资料,属于等级资料了)。描述形式:最常见采用“例数(%)”(一般文献中经常见到),主要要分清构成比(结构相对数)和率(强度相对数)的差别(表3)。而且在应用时,分母(就是样本量啦)一般不宜过小,分母太小不足以反映数据的客观事实,也不稳定。表3 计数资料常用统计指标的特点及其应用场合比如说:1.某地肺癌患者中男性A例,女性B例,则当地肺癌患者的性别比为A/B就是“比”。2.某次研究共检出了致病菌3种,总株数为A+B+C,其中一种致病菌检出株数为A,那么A/(A+B+C)就是构成比,即该种致病菌占总致病菌的比重或分布。3.某研究对患者(总例数为B)进行治疗,结果治愈的患者例数为A,则A/B即为率(可以理解为治愈率)。统计推断方法:一般分为单因素和多因素两种。单因素分析方法分析要点:一是划清数据类型(计数资料);二是明确试验设计类型(完全随机设计?几组样本?);三是注意所用方法的应用条件;四是多样本率比较,若卡方检验的P<,需再进一步两两比较,并进行Bonferroni校正,以控制假阳性(图3)。图3 计数资料统计方法的正确选择提醒两点:① 构成比是以100作为基数,各构成部分所占的比重之和必须为100%,故某组成部分所占比重的增减必影响其它组成部分的比重;② 构成比和率在实际应用时容易混淆,主要区别在分母上,所以应正确选择分母。多因素分析一般采用回归分析,主要是Logistic回归分析,以后会给大家介绍此方法。3.等级资料特点:属于多分类资料,满足多分类在性质上有程度等级上的差别,各分类属性按一定顺序排列(有序),即为等级资料。描述形式:最常见采用“例数(%)”(一般文献中经常见到),这和计数资料的描述大体相同,主要区别在于多个分类排列时一定要按照顺序进行(从小到大或从弱到强)。统计推断方法:等级资料的统计分析方法在单因素分析中采用非参数检验(秩和检验),当然对于双向有序R×C资料,也就说分组变量和结局变量都是有序(等级)的情况,构成比的比较采用卡方检验,程度的比较采用秩和检验,趋势关联性的比较用秩相关(也称等级相关)。多因素分析中采用有序Logistic回归。注意:分类变量(计数资料和等级资料)在软件分析操作时,要适当数量化处理(赋值),赋值情况会直接影响统计分析结果的解释。最后用下面这张图来总结基本统计学方法的选择(图4)。图4 常用基本统计学方法的正确选择今天的内容就到这里,同学们多多复习,有什么问题和不懂的可以在下面留言,我们会请刘岭教授一一解答。好了,让我们期待下一期吧!撰稿:刘岭 约稿编辑:刘芹排版:毕丽 审核:王东专家简介刘岭:陆军军医大学卫生统计学教研室副教授,主要从事卫生统计学教学、科研工作。担任中华卫生信息学会第八届统计理论与方法专业委员会委员,重庆市预防医学卫生统计专业委员会副主任委员,并担任《第三军医大学学报》等多家杂志的编委、统计审稿专家。历史推荐医学科研课堂丨统计说说(四):统计学方法之灵魂—方差分析 医学科研课堂丨统计说说(三):你所应该了解的正态、方差齐性检验 医学科研课堂丨统计说说(二):你的t检验做对了吗? 医学科研课堂丨统计说说(一):样本量估算是个什么东东?
科学研究很早就已经从简单的定性分析深入到细致的定量分析,科研工作者要面对大量的数据分析问题,科研数据的统计分析结果直接影响着论文的结果分析。在医学科研写作中,实验设计的方法直接决定了数据采取何种统计学方法,因为每种统计方法都要求数据满足一定的前提和假定,所以论文在实验设计的时候,就要考虑到以后将采取哪种数据统计方法更可靠。医学统计方法的错误千差万别,其中最主要的就是统计方法和实验设计不符,造成数据统计结果不可靠。下面,医刊汇编译列举一些常见的可以避免的问题和错误:打开百度APP,查看更多高清图片一、数据统计分析方法使用错误或不当。医学论文中,最常见的此类错误就是实验设计是多组研究,需要对数据使用方差分析的时候,而作者都采用了两样本的均数检验。二、统计方法阐述不清楚。在同一篇医学论文中,不同数据要采取不同统计处理方法,这就需要作者清楚地描述出每个统计值采用的是何种统计学方法,但在许多使用一种以上数据统计分析方法的医学论文中,作者往往只是简单地把论文采用的数据统计方法进行了整体罗列,并没有对每个数据结果分析分别交代具体的统计方法,这就很难让读者确认某一具体结果作者到底采用的是何种数据分析方法。三、统计表和统计图缺失或者重复。统计表或者统计图可以直观地让读者了解统计结果。一个好的统计表或统计图应该具有独立性,即作者即使不看文章内容,也可从统计表或统计图中推断出正确的实验结果。而一些医学论文只是简单地堆砌了大量的统计数字,缺乏直观的统计图或表;或者虽然也列出了统计表或统计图,但表或图内缺项很多,让读者难以从中提取太多有用的信息。另外,也有作者为了增加文章篇幅,同时列出统计表和统计图,造成不必要的浪费和重复。统计表的优点是详细,便于分析研究各类问题。统计图(尤其是条形统计图)的优点是能够直观反映变量的数量差异。医学论文中对数据统计结果的解释,最常见的两个错误就是过度信赖P值(结果可信程度的一个递减指标)和回避阴性结果。前一个错误的原因是因为一些作者对P值含义理解有误,把数据的统计学意义和研究的临床意义混淆。所以医学研究人员一定要注意不能单纯依靠统计值武断地得出一些结论,一定要把统计结果和临床实践结合在一起,这样才会避免出现类似的错误。至于回避阴性结果,只提供阳性结果,是因为不少作者在研究设计时,难以摆脱的一种单向的思维定式就是主观地先认定自己所预想的某种结果结论。在归纳某种结果原因时,从一个方向的实验就下完美的结论,尤其是如果这个结论可能对实际情形非常有意义时。这样的思维定势过于强调统计差异的显著性,有时会刻意回避报道差异的不显著结果,不思考和探究差异不显著的原因和意义,反而会因此忽视一些重大的科学发现。
常用的医学科研统计方法有:计量资料的统计方法可分为参数检验法和非参数检验法。参数检验法主要为t检验和方差分析(ANOVN,即F检验)等,两组间均数比较时常用t检验和u检验,两组以上均数比较时常用方差分析;非参数检验法主要包括秩和检验等。t检验可分为单组设计资料的t检验、配对设计资料的;方差分析可用于两个以上样本均数的比较,应用该方法时,要求各个样本是相互独立的随机样本,各样本来自正态总体且各处理组总体方差齐性
医学统计方法概述 第一节 医学统计学 在临床医学中的作用和意义 一、医学统计学 1、统计学 统计学(statistics)是研究数据搜集、整理与分析的科学,是认识社会和自然现象数量特征的重要工具。 2、医学统计学 统计学在医学研究领域的应用称为医学统计学。 医学统计学与生物统计学、卫生统计学是统计学原理和方法在互有联系的不同学科领域的应用,三者间有少许区别,但无截然界限。 二、医学统计学在临床医学中的应用及意义 1、临床科研设计 2、对搜集资料的内在规律进行分析 3、为医务工作者阅读科技文献和撰写科研论文提供工具 第二节 统计工作的基本步骤 统计工作的基本步骤通常分为四步:(研究)设计、搜集资料、整理资料和分析资料。 一.研究设计(design) 设计一般包括专业设计和统计设计。专业设计即确定调查题目、内容等。统计设计包括资料收集、整理与分析。 统计设计包括资料收集、整理与分析全过程的统计设想和科学安排。 设计需考虑以下几方面: 1、研究的目的和假设是什么? 2、研究对象的选择范围是什么?如何确定? 3、研究方法是什么?技术路线如何? 4、具体的研究内容、观察项目与指标是什么? 5、研究对象的数量大小,如何抽样?怎样分组? 6、对观察指标如何进一步计算?具体采用哪些统计分析方法? 7、有哪些可能存在的误差?如何避免与减少其影响? 8、时间、人员、经费方面的安排。 实验三要素:处理因素、受试对象、实验效应 设计四原则:对照、随机化、重复、盲法 二、搜集资料(data collection) 按照设计要求,原则是及时、准确、完整地收集原始数据。 1、病历 2、日常医疗工作记录 3、临床检查与化验记录 4、疾病监测报表 5、专题研究 三、整理资料(data sorting) 1、资料的录入和清理 资料录入前后初步的清理是核实,其次是发现异
是目前国际上最为流行的一种大型统计分析系统,被誉为统计分析的标准软件。尽管价格不菲,SAS已被广泛应用于政府行政管理,科研,教育,生产和金融等不同领域,并且发挥着愈来愈重要的作用。目前SAS已在全球100多个国家和地区拥有29000多个客户群,直接用户超过300万人。在我国,国家信息中心,国家统计局,卫生部,中国科学院等都是SAS系统的大用户。尽管现在已经尽量“傻瓜化”,但是仍然需要一定的训练才可以使用。因此,该统计软件主要适合于统计工作者和科研工作者使用。
SPSS作为仅次于SAS的统计软件工具包,在社会科学领域有着广泛的应用。SPSS是世界上最早的统计分析软件,由美国斯坦福大学的三位研究生于20世纪60年代末研制。由于SPSS容易操作,输出漂亮,功能齐全,价格合理,所以很快地应用于自然科学、技术科学、社会科学的各个领域,世界上许多有影响的报刊杂志纷纷就SPSS的自动统计绘图、数据的深入分析、使用方便、功能齐全等方面给予了高度的评价与称赞。迄今SPSS软件已有30余年的成长历史。全球约有25万家产品用户,它们分布于通讯、医疗、银行、证券、保险、制造、商业、市场研究、科研教育等多个领域和行业,是世界上应用最广泛的专业统计软件。在国际学术界有条不成文的规定,即在国际学术交流中,凡是用SPSS软件完成的计算和统计分析,可以不必说明算法,由此可见其影响之大和信誉之高。因此,对于非统计工作者是很好的选择。
它严格说来并不是统计软件,但作为数据表格软件,必然有一定统计计算功能。而且凡是有MicrosoftOffice的计算机,基本上都装有Excel。但要注意,有时在装Office时没有装数据分析的功能,那就必须装了才行。当然,画图功能是都具备的。对于简单分析,Excel还算方便,但随着问题的深入,Excel就不那么“傻瓜”,需要使用函数,甚至根本没有相应的方法了。多数专门一些的统计推断问题还需要其他专门的统计软件来处理。
这是统计学家喜爱的软件。不仅由于其功能齐全,而且由于其强大的编程功能,使得研究人员可以编制自己的程序来实现自己的理论和方法。它也在进行“傻瓜化”,以争取顾客。但仍然以编程方便为顾客所青睐。
这个软件是很方便的功能强大而又齐全的软件,也已经“傻瓜化”,在我国用的不如SPSS与SAS那么普遍。
也是功能强大而齐全的“傻瓜化”的软件,在我国用的也不如SAS与SPSS那么普遍。
这是一个主要处理回归和时间序列的软件。
excel, matlab, S-Plus , STATA等。中科大的好多人喜欢用origin。
不用的统计软件都有自己的优势和不足。量化统计分析的统计软件介绍,供你参考。质性的Nvivo等,看样子不是你关心的。一:SAS统计软件SAS 是英文Statistical Analysis System的缩写,翻译成汉语是统计分析系统,最初由美国北卡罗来纳州立大学两名研究生开始研制,1976 年创立SAS公司, 2003年全球员工总数近万人,统计软件采用按年租用制,年租金收入近12亿美元。SAS系统具有十分完备的数据访问、数据管理、数据分析功能。 在国际上, SAS被誉为数据统计分析的标准软件。SAS系统是一个模块组合式结构的软件系统,共有三十多个功能模块。SAS是用汇编语言编写而成的,通常使用SAS需要编写程序, 比较适合统计专业人员使,而对于非统计专业人员学习SAS比较困难。SAS最新版为版。二、 SPSS统计软件 SPSS是英文Statistical package for the social science 的缩写,翻译成汉语是社会学统计程序包,20世纪60年代末由美国斯坦福大学的三位研究生研制,1975年在芝加哥组建SPSS总部。SPSS系统特点是操作比较方便,统计方法比较齐全,绘制图形、表格较有方便,输出结果比较直观。SPSS是用FORTRAN语言编写而成。适合进行从事社会学调查中的数据分析处理。最新版为版。三、 BMDP统计软件 BMDP是英文Biomedical computer programs 的缩写,翻译成汉语是生物医学计算程序, 美国加州大学于1961年研制,是世界上最早的统计分析软件。特点是统计方法齐全,功能强大。但1991年的版后没有新的版本推出,使用不太普及,最后被SPSS公司收购。四、 Stata统计软件 Stata统计软件由美国计算机资源中心(Computer Resource Center)1985年研制。 特点是采用命令操作,程序容量较小,统计分析方法较齐全,计算结果的输出形式简洁,绘出的图形精美。不足之处是数据的兼容性差,占内存空间较大,数据管理功能需要加强。最新版为版。五、 EPINFO软件 EPINFO是英文Statistics program for epidemiology on microcomputer 的缩写,翻译成汉语是流行病学统计程序。美国疾病控制中心CDC和WHO共同研制,为完全免费软件。特点是数据录入非常直观,操作方便,并有一定的统计功能,但方法比较简单,主要应用于流行病学领域中的数据录入和管理工作。最新版为Epidata 版及EPINFO2000版。 六、 Minitab Minitab由美国宾州大学研制。其特点是简单易懂,很方便进行试验设计及质量控制功能。在国外大学统计学系开设的统计软件课程中,Minitab与SAS、BMDP并列,根据没有SPSS的份。最新版本为版七、 Statistica Statistica为一套完整的统计资料分析、图表、资料管理、应用程式发展系统;美国StatSoft公司开发。能提供使用者所有需要的统计及制图程序,制图功能强大,能够在图表视窗中显示各种统计分析和作图技术。 八、 SPLM统计软件 SPLM是英文Statistical program for linear modeling 的缩写,翻译成汉语是线性模型拟合统计软件程序。1988年由解放军第四医学大学统计教研室研制。系统特点是采用线性模型的方法,实现各种统计方法的计算。统计方法比较齐全,功能比较强大。SPLM采用FORTRAN语言编写完成。但1999年推出版后无新的产品推出。九、 CHISS统计软件 CHISS 是英文Chinese High Intellectualized Statistical Software的缩写,翻译成汉语是中华高智统计软件, 由北京元义堂科技公司研制,解放军总医院、首都医科大学、中国中医研究院等参加协作完成。1997年开始研发,2001年推出第一版。CHISS是一套具有数据信息管理、图形制作和数据分析的强大功能,并具有一定智能化的中文统计分析软件。CHISS的主要特点是操作简单直观,输出结果简洁。既可以采用光标点菜单式也可采用编写程序来完成各种任务。CHISS用C++语言、 FORTRAN语言和delphi 开发集成,采用模块组合式结构,已开发十个模块。 CHISS可以用于各类学校、科研所等从事统计学的教学和科研工作。最新版为CHISS2004版。十、 SASD统计软件 SASD是英文package for Statistical analysis of stochastic data 的缩写,翻译成汉语是随机数据统计分析程序包。它是由中国科学院计算中心研制。系统特点是以FORTRAN源程序形式向用户提供大量的子程序可供用户进行二次开发,统计方法比较齐全,功能比较强大。SASD采用FORTRAN语言编写完成,比较适合从事统计专业人员使用。但无新版推出。 十一、 PEMS统计软件 PEMS是英文package for encyclopaedia of medical statistics汉语是中国医学百科全书-医学统计学软件包。它以<中国医学百科全书>一书为蓝本,开发的一套统计软件。系统特点是实现各种统计方法的计算。统计方法比较齐全,功能比较强大。PEMS采用TURBO C和TURBO BASIC语言编写完成,比较适合从事医学工作的非统计专业人员使用。最新版为版。十二、 EXCEL电子表格与统计功能 EXCEL电子表格是Microsoft公司推出的Office系列产品之一,是一个功能强大的电子表格软件。特点是对表格的管理和统计图制作功能强大,容易操作。Excel的数据分析插件XLSTAT,也能进行数据统计分析,但不足的是运算速度慢,统计方法不全。 十三、 DAS统计软件 DAS是英文Drug and Statistics的缩写,翻译成汉语是药理学计算软件,由孙瑞元等开发。特点是内容涵盖基础药理学、临床药理学,药学,医学统计学。能多种处理结果同时显现。EXCEL平台使用方便,智能化,图表直接插入文档。十四、 SDAS统计软件DAS是英文Statistical design and analysis system的缩写,翻译成汉语是统计设计和分析系统。1992年由解放军总医院医学统计教研室开发。特点是窗口操作,操作方便,图表简明,与国内医学统计学教材一致。但只有DOS版,1995年后没新的版本。十五、 Nosa统计软件Nosa是非典型数据分析系统,1999年由解放军四军医大学医学统计教研室夏结来教授开发。特点是采用广义线性模型建模,从数据录入与管理、统计分析、绘图,到结果管理嵌入了当代数据处理技术。但只有DOS系统下使用。来源:
excel只能做简单的数据处理,稍微难度些的建模分析,则需要用spss或者r等,一般毕业设计中都是不承认excel的吧
统计学是一门抽象难懂的学科,非统计学专业毕业人员一般很难做到精通。下文是我为大家整理的关于统计类论文投稿的范文,欢迎大家阅读参考!
医学统计学方法应用的错误解析
一、引 言
医学由于其研究的复杂性和系统性,常需要应用严谨的统计学方法,由于有些作者对医学科研的统计学理论和方法的应用缺乏深刻了解,在医学论文中错误应用统计学方法的现象时有发生。统计学方法应用的错误直接导致统计结果的错误。例如统计学图表、统计学指标、统计学的显著性检验等。因此,正确应用统计学方法,并将所获得的结果进行正确的描述有助于单篇论著的质量提高,现将医学论文中统计学方法应用及其常见结果的错误解析如下。
二、医学论文统计学方法应用概况
医学论文的摘要是全文的高度浓缩[1],主要由目的、方法、结果、结论组成。一般要求要写明主要的统计学方法、统计学研究结果和P值。一篇医学论文的质量往往通过摘要的统计学结果部分就能判断。统计学方法的选择和结果的表达直接影响单篇论著的科研水平。
(一)材料与方法部分
正文中,材料与方法部分必须对统计学方法的选择、应用、统计学显著性的设定进行明确说明。通过对统计学方法的描述,读者应该清楚论著的统计学设计思路。材料部分要清楚说明样本或病例的来源、入组和排除标准、样本量大小、研究组和对照组的设定条件、回顾性或者前瞻性研究、调查或者实验性研究、其他与研究有关的一般资料情况,其目的是表明统计学方法应用的合理性和可靠性,他人作相关研究时具备可重复性。方法部分应详细叙述研究组和对照组的不同处理过程、观察的具体指标、采用的测量技术,要具备可比较性和科学性,
方法部分还要专门介绍统计分析方法及其采用的统计软件。不同的数据处理要采用不同的方法,必须清楚的说明计数或者计量资料、两组或者多组比较、不同处理因素的关联性研究。常用的有两组间计量资料的t检验,多组间计量资料的F检验,计数资料的卡方检验,不同因素之间的相关分析和回归分析。有些遗传学研究方法还有专门的统计学方法,要在这里简要说明并给出参考文献,还要简单叙述统计方法的原理。统计学软件要清楚的说明软件的名称和版本号,如基于家系资料研究的版本。
(二)论文结果部分
论文结果部分要显示应用统计学方法得到的统计量[2],所采用的统计学指标较多时,往往分开叙述。分组比较多时还要借助统计图表来准确表达统计结果。对于数据的精确度,除了与测量仪器的精密程度有关外,还与样本本身的均数有关,所得值的单位一般采用紧邻均数除以三为原则。均数和标准差的有效位数要和原始数据一致。标准差或标准误差有时需要增加一个位数,百分比一般保留一个小数。在统计软件中,分析结果往往精确度比较高,一般要采用四舍五入的方法使其靠近实验的实际情况,否则还会降低论文的可信度和可读性。
结果部分的统计表采用统一的“三线”表,表题中要注明均数、标准差等数据类型。表格中的数值要按照行和列进行顺序放置,要求整齐美观,不能出现错行现象。要明确标注观察的例数,得到的检验统计量。统计图可以直观的表达研究结果,如回归和相关分析的散点图可以显示个体值的散布情况。曲线图表达个体均值在不同组别随时间变化的情况或者不同条件下重复测量的结果。误差条图由均数加减标准误绘出,描述的是67%的置信区间,不是95%,提倡在误差条图采用95%的置信区间。
关于统计量,一般采用均数与标准差两个指标,均数不宜单独使用。使用均数的时候要明确变异指标标准差或者精确性指标标准误。关于百分比,分母的确定必须要符合逻辑,过小的样本会导致分母过小而出现百分比过大的情况。百分率的比较要写清两者中不同的变化,可以采用卡方检验。
1.假设检验的结果中,常见只写P值的情况,有时候会误导读者,也会隐藏计算失误的情况,因此写出具体的统计值,如F值、t值,可以增强可信度。对于率、相关系数、均数这类描述统计量,要清楚写明进行过统计学检验并将结果列出。P值一般取与作为检验显著性,对于结果的计算要求具体的P值,如P=或P=。
2.在对论文进行讨论时,作为统计学方法产生的结果往往要作为作者的主要观点支持其科学假设,对统计结果的正确解释至关重要。P值很大表明两组间没有差别属于大概率事件,P值很小表明两组间没有差别的概率很小。当P<,表明差异具有统计学意义。P值与观察的样本量的大小有关联,当样本量小的时候,数据之间的差别即使很大,P值也可能很大;当样本量大时,数据之间的差别即使很小,P值也可能显示有显著性差异。相关系数统计学意义的显著性也与相关系数的大小没有绝对的关联,有统计学意义的样本相关系数可能很小。因此,有统计学差异的描述并不一定意味着两组间差别很大,错判的危险性很大,显著性的检验为定性的结果,结合统计量大小方可判断是否具有专业意义。
变量间虚假的相关关系与变量随时间变化而变化相关,统计学意义的关联并不表示变量间一定存在因果关系。因果关系的确定要根据专业知识和采用的研究方法的不同来考量。使用回归方程进行分析,当两变量间具有显著性关系,但是从自变量推测因变量仍然不会很精确。相关或回归系数不能预测推测结果的精确程度,而只是预测一个可信区间。诊断性检验应用于人群发病率很低的疾病,灵敏度、特异度的高低对于明确疾病诊断并不能很肯定。“假阳性率”与“假阴性率”根据实际的需要不同要求并不一致,在疾病患病率很低时,出现假阳性也是正常的,要确诊疾病必须要与临床症状体征相结合。因此,这两个率的计算方法必须交待清楚。
三、医学论文统计学方法应用的常见错误分析
(一)“材料与方法”中的统计学方法应用的常见错误
“材料与方法”中统计学方法常见的问题主要为:对样本的选择或者研究对象的来源和分组描述很少或者过于简单。例如,临床入组病例分组只采用简单的随机分组,未描述随机分组的方法,未描述是否双盲双模拟,未设置空白对照组,分组后对性别、年龄、文化程度的描述未进行统计学检验,对于特殊的统计学方法没有详细交代;动物实验分组的随机化原则描述过于简单,没有具体说清完全随机、配对或分层随机分组等;统计分析方法没有任何说明采用的分析软件,有的只说明采用的分析软件而不交代在软件中采用的统计方法;没有说明原因的情况下出现样本量过于小等情况。
(二)“结果”统计学方法应用的常见错误
1.应用正确的统计学方法出现的结果表达并不一定正确。例如前文所述数据的精确度要求。医学论文常见错误中包括均数、标准差、标准误等统计学指标与原始数据应保留的小数位数不同;对于率、例数、比值、比值比、相对危险度等统计学指标保留的小数点位数过多;罕见疾病的发病率、患病率、现患率等指标没有选择好基数,导致结果没有整数位;相关系数、回归系数等指标保留的小数位数过多或者过少;常用的一些检验统计量,如F值、t值保留的位数不符合要求。
2.对统计学指标进行分析和计算时,一般采用计数资料和计量资料进行区分。计量资料常用三线表,在近似服从正态分布的前提下采用均数、标准差进行说明,如果不符合正态分布时,可以采用加对数或其他的处理方式使其近似正态分布,否则只能采用中位数和四分位数间距等指标进行描述。医学论文中常见未对数据进行正态分布检验的计算,影响统计结果的真实性和可信度。对于率、构成比等常用的计数资料指标,常见样本量过小的问题,采用率进行描述会影响统计结果的可靠性,采用绝对数进行说明会显得客观一些。还有一些文献将构成比误用为率,也是不可取的。
3.在判断临床疗效之一指标时,两组平均疗效有差别并不意味着两组的每一个个体都有效或无效,必须通过计算有效率进行计算。如比较某药物治疗糖尿病的疗效,服药一周后,研究组和对照组的对血糖降低值分别为 ± 和 ± ( P = 1) 。按空腹血糖值低于的疗效判定有效率,研究组和对照组的有效率分别为和 ,尽管平均疗效相差较多,但也要注意到该药物对部分患者无效()。对假设检验结果的统计学分析结果,P 值的表达提倡报告精确P值,如P = 或P = 等。目前的统计学分析软件均可自动计算精确的P 值。例如常用的SAS,SPSS等,只要提供原始数据,就可以计算出t值、F值和相应的自由度,并可获得精确的P值。
四、小 结
提高医学论文中统计学方法的使用质量是编辑部值得重视的一项长期而又艰巨的工作[3],医学论文中统计方法应用和统计结果的表达正确与否,不仅体现了论文的科学性和严谨性,而且对于提高期刊整体的学术质量,促进医学科学的发展和传播也有着重要作用[4]。
参考文献:
[1] 李敬文,吕相征,薛爱华.医学期刊评论性文章摘要的添加对期刊被引频次的影响[J].编辑学报,2011(23).
[2] 陈长生.生物医学论文中统计结果的表达及解释[J].细胞与分子免疫学杂志,2008(24).
[3] 潘明志.新时期复合型医学科技期刊编辑应具备的素质和能力[J].中国科技期刊研究,2011 (22).
统计学专业毕业现状分析与对策研究
本科毕业论文是高等学校人才培养计划的重要组成部分,是本科教学过程中最后一个重要的教学实践环节,是学士学位授予的一个重要依据。[1,2]然而,相较于其他教学环节,毕业论文没有受到足够的重视,从而导致该环节存在着一些问题。[3]本文将以中央民族大学统计学专业毕业论文为例,在分析其现状的基础上,找到问题并提出相应的建议。
中央民族大学统计学本科专业设置于2003年,目前已有六届毕业生。经过学院和学校层面的努力,统计学专业作为新办专业取得了较快发展,所培养的学生具有较好的专业能力和综合素质,近四成学生继续读研深造,就业的学生大都在专业对口的工作岗位上,就业率一直在85%左右。
本科毕业论文环节在培养方案中是6个学分。学生在第七学期开始选择指导教师以确定毕业论文题目。经过前6个学期的系统理论学习,统计学专业学生已基本掌握了统计学的基础理论和基本方法,具备了正确的统计思想和较强的统计软件应用能力,以及运用所学的理论和方法解决实际问题、文献检索和资料查询等综合能力。本科毕业论文的写作就是统计学专业学生将上述基础和能力进一步深化与升华的重要过程,从而培养学生的创新能力和实践能力,使学生的知识、技能和素质得到进一步的充实和提高,同时也是衡量学校教学质量和办学水平的重要指标。因此对如何提高毕业论文质量进行研究是必要和有意义的。[4]
一、统计学专业毕业论文质量的现状分析
从论文完成情况来看,每届的毕业论文基本都能达到论文教学环节的要求,通过对中央民族大学统计学专业2007~2011年四届毕业生的毕业论文进行分析,发现毕业论文及格率为。
从毕业论文研究的类型来看,主要分为两大类:理论研究型论文和实证型论文,理论研究型论文表现为总结和论述现有统计理论问题,表述理论研究的成果,或应用理论对现实问题进行分析、说明,并提出自己的思考;实证型论文主要表现为针对某一特定的实际目的或目标,运用所学统计的理论和方法,对经济、管理、金融、医学、生物、工程、环境等领域进行统计调查、统计信息管理、数量分析等。
从论文知识点范围的分析来看,学生论文绝大多数是统计专业问题,极少数是其他数学分支的问题。从中央民族大学历届统计学专业学生的毕业论文情况分析,发现毕业论文中研究其他数学分支的问题占总数的,主要包括:一是其他科目的应用研究(数学分析、常微分方程、运筹学及空间解析几何等),占总数的。二是数学专业教育和数学思维的研究,占总数的。研究统计学专业问题的毕业论文占绝大部分,比例为,选题内容广泛且多为社会热点问题,涉及经济、社会、医疗卫生、教育发展、旅游、基础设施建设等多领域,由于受学校人文环境影响,很大比例的学生对少数民族地区的经济、社会、民生等问题进行了统计分析,约占总学生人数的。所使用的分析方法主要集中于抽样调查、回归分析、多元统计方法、聚类分析、判别分析等常用统计方法。
此外,统计分析显示学生成绩普遍偏高,统计学专业学生的毕业论文,尤其是实证类论文,存在着可以大量使用背景介绍和统计软件分析结果的特点,因此,一些论文没有创新性和学术含量,但具有较大的篇幅,与理学院其他专业的毕业论文成绩比较,其平均成绩相对较高,约分。
二、统计学专业毕业论文存在的问题
毕业论文的质量问题关系到本科人才的培养规格和目标,直接体现了学生本科阶段的学习成果,是衡量教学水平、学生毕业与学位资格认证的重要依据。通过对论文和考评结果的具体分析,发现学生的毕业论文在创新性、理论深度及论文写作常识多方面存在问题。具体表现为:
1.创新性不够
学生的毕业论文表现为理论性研究非常少,大都是实证型论文,并且多是简单的统计方法应用,缺少创新性研究和思考。从中央民族大学历届统计学专业学生的毕业论文来看,理论研究型论文只占,与实证型论文的比例为1︰,比例悬殊,体现了学生在毕业论文大的选题过程中,避重就轻,缺乏创新的特点。如每年都有一定数量的学生选择“我国人均GDP的预测”这类针对某经济指标进行预测的题目,论文的主要内容就是利用ARMA、灰色预测或者趋势外推方法等一种或多种方法对时间序列数据做简单建模和分析,论文没有对指标本身的意义以及国内国际的社会经济形势进行综合分析。这种方法简单套用性质的论文占有很大的比重。
2.选题过大、内容空泛,缺乏深入研究,存在抄袭、拼凑现象
有些学生在选择研究课题时,往往不能根据自身的专业知识结构特点和社会实践情况进行准确定位,只是一味的盲目的选择一些过大过空的社会热点问题,因此难以看到所要研究的问题的本质。如有的学生针对CPI做研究,没有深入了解问题的实质,只是收集了一些文献,很难提出自己的观点或研究角度,造成了材料堆积且过于散乱,论文变成了一些材料的简单拼凑。有些论文针对某一社会经济问题进行研究,论文的主题只是针对现有数据利用简单的统计方法进行分析,对数据的质量和可靠性以及方法的适用性不做针对性讨论,对所得的结论也不结合社会经济现实情况进行分析,导致论文质量不高。
3.相对前沿的分析方法利用较少
前沿的分析方法利用较少,通过毕业 论文的 写作, 统计分析能力没有实质性提升。学生论文使用的统计方法主要集中于回归分析、聚类分析、判别分析、相关性分析等,其中回归分析方法占有非常大的比例,约,其他各统计方法使用的比例分别为:聚类分析为,判别分析为,相关性分析为,多元统计方法为,时间序列分析为,极少有学生使用教科书外的相对前沿的分析方法。
4.论文写作上存在结构不合理、没有相关研究介绍、创新点表述不清、参考文献不会正确标注等问题
从学生的毕业论文来看,论文写作不规范,专业性差。主要存在论文形式不规范、结构不合理、题目含糊、有些论文杂乱无章、口语化严重、可读性差等问题。
三、存在问题的原因分析
针对上述问题,统计学系通过对论文进行详细审查以及 组织指导教师和学生座谈,发现毕业论文出现以上问题的主要原因包括以下几方面:
1.学生对论文不够重视
部分学生由于忙于考研学习而无暇顾及毕业论文的研究,还有部分学生由于忙于外出找 工作、 实习而无心认真撰写论文。论文撰写所需的必要时间难以得到保障,因此学生应付了事,从而无法保证论文的深度。此外,还有部分学生认为毕业论文只是一个教学环节,与考研的好坏无关,存在只要写了论文,教师都会让自己通过的侥幸 心理,在思想上没有引起足够的重视。
2.缺乏指导教师的针对性指导
指导教师所带毕业生人数过多,使得导师的工作量呈现超负荷状态,无法保证每个学生毕业论文的质量,从而致使部分学生的论文规范性较差,没有对存在的问题反复修改,使得学生论文存在诸多问题。
3.学生的专业训练还不够
大部分本科生没有经历过论文的写作训练,写作水平较低,不了解学术论文的规范性及其格式,不知如何从科研的角度构思文章、组织材料、安排结构,使得相当一部分学生的毕业论文表达的观点不够准确清楚,论据亦不能很好地支持论点。另外,一些同学为了完成任务,直接将在 网络中搜索到的资料不假思索的拼凑在一起,使得内容不成体系,观点混乱。
四、提高毕业论文质量的建议和 实践
1.加强毕业论文重要性的宣传,提高学生的重视度
加强对毕业论文重要性的认识有助于提高本科生毕业论文的质量。通过讲座、课堂传授等形式,让学生意识到毕业论文的实践性和综合性是任何教学环节都不能替代的,是提高发现问题、分析问题、解决问题能力的有效途径,更是进行个人综合素质提高的必不可少的重要环节,[4]从而使学生在思想上认识到毕业论文的重要性,投入更多精力进行毕业论文设计。
2.选题和教师的科研项目相结合,提高论文的创新性
在选择课题时,为了能充分发挥学生的主观能动性,可以让学生根据自身的特点,与指导教师协商,结合导师的研究方向制定课题方案。统计学专业的教师一般除了 申请国家自然科学基金和国家 社会科学基金这类对理论性和创新性要求较高的项目以外,很多教师还主持或参加有相应的 应用研究类项目。应用类项目大都需要实地调研(以及问卷涉及和数据分析)或者大量的数据分析和建模。引导学生参加这类项目来设计和完成自己的本科毕业论文,能够激发学生的科研热情和创新潜力。此外,鼓励和引导一些成绩较好,如让具备保研资格的学生参加教师的科研讨论班或者课题组,选择一些具有一定难度的理论问题进行研究,可以使学生了解本学科的 发展方向和最新动态。最近两年,越来越多的学生,特别是具备了保研资格的学生,在大四上学期就能投入到项目和毕业论文的写作中。
3.重视平时实践教学环节,培养学生的实践能力、发现问题以及解决问题的能力
为了提高学生的学习兴趣以及对问题的分析、解决能力,广泛开展了丰富多彩的社会实践活动,使学生尽可能早地接触与本专业有关的实际工作,切身 体会到如何将理论与实际相结合,了解本学科的实际业务,从而提高自主学习能力,加强专业知识的把握。结合学校的实际情况,积极鼓励学生在大二和大三阶段参加校级和国家级的全国大学生数学建模竞赛,申请“中央民族大学本科生研究训练 计划项目”、“北京市大学生科学研究计划项目”和“国家大学生创新性试验计划项目”。项目的申请和实施以及研究 报告的写作,对学生来说都是一个很好的锻炼。目前,统计学专业本科生的参与率在70%以上。此外,建立专业实习基地可以提高学生利用专业知识分析和解决实际问题的能力。这些环节的设计和实施都有力地保障了学生本科毕业论文的水平和质量。
4.加强学生科技论文写作训练
加强平时课堂上大作业的规范化,潜移默化培养学生科技论文的写作能力。通过平时的实践活动,如学生数学建模以及大学生创新实践等各类实践性项目来提高学生的 论文 写作能力。
5.实施激励措施,激发学生的兴趣和主动性
针对那些参与实际课题的学生,学院鼓励指导教师根据学生的完成情况以劳务费的形式给予其奖励,另外积极鼓励毕业论文质量优秀的学生进行投稿 发表。此外,还需对答辩程序和评分标准进行规范化,建立优秀毕业论文指导教师和优秀毕业论文奖励制度,以形成积极的导向作用,充分调动指导教师和学生的积极性。
6.加强教师责任心,建立完善的机制
加强学生毕业论文的过程 管理,从开题到中期检查严格执行,指导教师严格把关。为了保证学生与教师之间的沟通,学校可以通过建立师生信息反馈机制改善师生分离状态,为师生提供便利的沟通渠道,同时设置适当的教师激励制度,中央民族大学目前对教师指导本科毕业论文有额外的课时补贴。
流行病学与统计 医学统计学:根据统计学的原理和方法,研究医学数据收集、表达和分析的一门应用各学科。 医学统计的主要内容: 研究对象:医学数据 统计设计:调查设计和实验设计 统计描述:率、均数 统计推断:对统计指标的差别和关联性进行分析和推断 医学统计资料的类型 统计工作的基本步骤包括: 1. 研究设计 2. 收集资料:来源:经常性资料【医疗卫生工作记录(病历、医学检查记录、出生死亡报表等)健康检查记录】;一时性资料【专题调查或实验研究】。要求:完整、正确和及时;足够数量;代表性和可比性 3. 整理资料:原始数据的检查与核对:常规检查;取值范围检错;逻辑检错 数据的分组设计和归纳汇总。4. 分析资料:统计描述;统计推断(区间估计、假设检验) 统计工作的基本步骤包括: A .实验和调查 B.统计设计 C.收集资料 D.整理资料 E.分析资料 统计工作中,分析资料指的是: A .统计设计 B.收集资料 C.整理资料 D.统计描述 E.统计推断 总体:根据研究目的而确定的同质观察单位的全体。有限总体和无限总体。 样本:是从总体中随机抽取有代表性的部分观察单位变量值的集合。 参数:指总体指标。如总体均数μ,总体标准差σ,总体率π。 统计量:指样本指标。如样本均数 ,样本标准差S ,样本率p 。 误差:指实际值与真实值之差。分为随机误差(随机测量误差和抽样误差)、非随机误差(主要是系统误差) 概率是对总体而言。是某随机事件发生的可能性大小的数值,常用符号P 表示。取值范围0~1。 在统计学中,误差的种类有 A .标准误差 B.计算误差 C .系统误差√ D .随机测量误差√ E .抽样误差√ 统计学上的误差主要有 A. 系统误差 B.标准误差 C.随机测量误差 D.抽样误差 E.计算错误误差 算术均数: 简称均数,用于描述对称分布或近似正态分布的资料。 描述正态分布资料集中趋势的指标是 A. 百分位数 B.中位数 C.算术均数 D.几何均数 描述正态分布资料集中趋势的指标是 A. 中位数 B.几何均数 C.算术平均数 D.标准差 有9名健康成人的空腹胆固醇测定值(mmol/L)为,,,,,,,,。求算术均数。 有7份血清的抗体效价分别为1:2, 1:4, 1:8, 1:16, 1:32, 1:64, 1:128,求平均抗体效价。 n 5. 61+3. 96+3. 67+4. 99+4. 24+5. 06+5. 20+4. 79+5. 93= 9 43. 45= 9 =4. 83(m m ol /L ) X = G =lg -1( 血清抗体平均效价为1:16 注意:变量值中不能有0;不能同时出现负数和正数;若全为负数,计算时先把符号去掉计算 中位数(median, M):可用于任何分布的计量资料 有7名正常人的血压(舒张压)测定值(mmHg )为:72,75,76,77,81,82,86,87求中位数。 M =(77+81)/2=79 一组从小到大排列的定量变量,位次居中的指标是 A .算术均数 B.几何均数 C.中位数 D.百分位数 描述离散趋势的指标是 A. 标准差 B.中位数 C. 几何均数 D.算术均数 n lg 2+lg 4+lg 8+lg 16+lg 32+lg 64+lg 128 =lg -1() 7 =lg -1(1. 204) =16 lg X ) 方差(variance )与标准差(standard deviation):表示数据的平均离散情况,常用于描述服从正态分布的资料的离散程度。 某地20岁男子160人 某地不同年龄女童身高(cm )的变异程度 统计表的基本结构与要求:标题、标目、线条、数字4部分组成。表中数字区不插入文字,不列备注项。必须说明者表“*”号等,在表下方说明。 统计表的基本结构为 A .标题、横标目、纵标目、线条 B.标题、横标目、纵标目、数字 C .标题、横标目、纵标目、备注 D.标题、标目、线条、数字 统计表的基本构成有 A .标题 B.横标目 C.纵标目 D .线条 E.数字 统计表内不列的项是 A. 标目 B. 线条 C.数字 D.备注 制图的基本要求 (1)根据资料的性质和分析目的,选择合适的图形。 (2)基本结构:标题、标目、刻度、图例4部分组成。 标题:一般放在图的下方,左侧加图号 标目:分为横标目和纵标目,分别表示横轴和纵轴数字刻度的意义 刻度: 图例:说明统计图中各种图形锁代表的事物。放在右上角或下方中间 比较两家医院15年床位数的增加速度,可选用的统计图是 A .构成图 B .直条图 C .线图 D .直方图 某医院拟表示一年中各月病床使用率的变化趋势,应选用的统计图是 A .普通线图 B .直条图 C .散点图 D .直方图 比较某地2001年和2011年结核、心脏病和肿瘤的死亡率,可选择的统计图是 A. 单式条图 B.复式条图 C.普通线图 D.半对数线图 分析某医院1998年住院病人5种疾病构成比可选用的统计图是 A. 单式直条图 B. 复式直条图 C.圆图 D. 线图 分析某医院1998年和2008年住院病人5种疾病构成比可选用的统计图是 A .单式直条图 B.复式直条图 C.百分比条图 D.统计地图 观察某地十年肺结核患病率的变化趋势,可选择的统计图是 A. 条图 B.圆图 C.线图 D.直方图 比较某地2001年和2011年结核、心脏病和肿瘤的死亡率,可选择的统计图是 A. 单式条图 B.复式条图 C.普通线图 D.半对数线图 假设检验的基本步骤 1. 建立假设检验,确定检验水准 (1)根据统计推断目的提出对总体特征的假设 无效假设,或称为零假设,记作H0,即假设差异是由于抽样误差所致,总体参数相同 备择假设,记作H1,即差别不是由于抽样误差所致,总体参数不同 (2)确定检验水准亦称显著性水准,用α表示 2. 选定检验方法,计算检验统计量(卡方、t 值、F 值) 3. 确定P 值,做出统计推断结论 注意:假设检验是针对总体而言的 假设检验的注意事项 1.. 检验方法的正确选择 定量资料 两个独立样本均数比较:t 检验 多个独立样本均数比较:方差分析 配对设计:配对t 检验 随机区组资料:随机区组设计方差分析 2. 结果的解释:差别有统计学意义与有无实际意义的关系 I 型错误(第一类错误):指拒绝了实际上是成立的H0。用α表示。 II 型错误(第二类错误):指不拒绝实际上是不成立的H0。用β表示。 1. 流行病学研究的对象是( ) A.病人 B.健康人 C.人群 D.亚健康人 E.亚临床的人 下列哪一项是分析流行病学方法( ) A.横断面研究 B.生态学研究 C.疾病监测 D.病例对照研究 E.社区干预试验 有学者通过调查肺癌病人和非肺癌的人过去的吸烟情况,来研究吸烟和肺癌的关系。这种方法称为: A.现况调查 B.描述性研究 C.筛检试验 D.病例对照研究 E.队列研究 有学者对某人群进行了高血压的调查,获得了该人群高血压的患病率,并对不同年龄组的高血压患病情况进行了分析。这种调查研究属于: A.探讨疾病的病因 B.探讨发病机制 C.描述疾病的分布 D.研究疾病自然史 E.疾病筛检 计算患病率的分子是( ) A .观察期间某病的新发病例数 B.观察期间某病的新旧病例数 C .观察期间之后某病的患病人数 D.观察期间某病的暴露人口数 E .观察期间所有人口数 某地区在1个月内进行了糖尿病的普查,可计算当地糖尿病的( ) A .发病率 B.死亡率 C.患病率 D.二代发病率 E.罹患率 下面哪一个公式用于计算发病率(E ) A .(受检者中阳性人数/受检人数)×100% B.(受检者中阳性人数/同期暴露人数)×100% C .(受检者中阳性人数/受检者人数)×100% D.(受检者中阴性人数/受检者人数)×100% E.(某一时期内新病例数/同期暴露人数)×100% 一个地区通过首次高血压普查,可计算当地的( ) A .高血压患病率 B.高血压罹患率 C.高血压发病率 D.高血压病死率 E.家庭续发率 某地区1960年度疫情资料统计,狂犬病患者100人全部死亡,此资料可计算 A .粗死亡率 B.死亡专率C .标化死亡率 D.病死率 E.此资料不全难以计算 下列叙述中,不属于病例对照研究优点的是( ) A .资料收集后可在短时间内得到结果 B.特别适用于罕见病的研究 C .一次调查可同时研究一种疾病与多个因素的关系 D.可直接获得发病率资料 E .所需研究对象的数量相对较少 病例对照研究中的调查对象是( ) A .病例组是怀疑患有欲研究疾病的病人,对照组是未患该病的人 B .病例组是具有某种暴露的人,对照组是未有该暴露的人 C .病例组是确诊患有欲研究疾病的病人,对照组是未患该病的人 D .病例组和对照组均是具有某种暴露的人 E.病例组是确诊患有欲研究疾病的病人,对照组是怀疑患有该病的 在病例对照研究中,若病例组某危险因素暴露史的比例在统计学上明显高于对照组,则表明( D ) A .该因素与疾病有统计学关联 B.该因素与疾病有因果关联 C .该因素是疾病的病因 D.该因素与疾病无关联 E.该病由该因素引起 下列关于病例对照研究特点的说法中,正确的为( C ) A .暴露与疾病都是现在的情况 B.能够确证因素与疾病的因果关联 C .由因及果的研究 D.需要随机分组 E.属于观察法 OR 主要应用于( A ) A .现况研究 B.生态学研究 C.现场试验 D.病例对照研究 E. 队列研究 属于病例对照研究缺点的是( E ) A .不能分析疾病与多种因素的关联 B.不能估计RR C.样本含量要求很大 D .容易产生医德问题 E.回忆信息时,易出现错误 下列说法中,不属于队列研究特点的是( B ) A .由因及果,前瞻性研究 B.属于描述性研究 C.能同时研究一种因素与多种疾病的关系 D .需要设立对照组 E.因果关联的说服力大于病例对照研究 队列研究中的研究对象为( C ) A .在一般人群中选取有、无某暴露因素的两个组 B.在患有某病者中选择有、无某暴露因素的两个组 C .在未患该病人群中选择有、无某暴露因素的两个组 D.患有某种疾病的人群随机分成的两组 E .一组患有某种疾病者,一组为未患有该种疾病者 在队列研究中,暴露组的疾病发病率与对照组的疾病发病率的差值称为 ( A ) A . AR B. RR C.OR D.PAR E. AR% 队列研究属于( B ) A .相关性研究 B.分析性研究 C.描述性研究 D.理论性研究 E.实验性研究 在队列研究中,估计某因素与某疾病关联强度的指标为( E ) A .总人群中该病的发病率 B.暴露人群中该病的发病率 C .人群中危险因素的暴露率 D.OR E. RR 在队列研究中,研究对象的分组原则是按( A ) A .是否暴露于某因素分组 B.随机分组 C.是否患病分组 D.人为随意分组 E.领导意图分组 属于实验流行病学特征的是(E ) A .由果及因,回顾性研究 B.属于观察法 C.获得因素与疾病联系强度的指标主要为比值比 D .不能确证因果关联 E.人为施加干预措施 关于临床试验中的对照组,正确的说法为( B ) A .是人群中的非患欲研究疾病者 B.是患欲研究疾病者,但在处理上不同于实验组 C .不具有某种暴露因素的人 D.与患欲研究疾病者同时入院的其它患者 E.所欲研究疾病的轻型患者 多选题: 下列所述中属于抽样调查优点的有( A C D ) A .工作量小 B.工作量大 C.省时间和人力、物力 D.工作易做到细致 E .特别适用于患病率很低的疾病调查 属于队列研究缺点的为( A C D ) A .观察时间长,花费大 B.易出现回忆偏倚 C.不宜用于研究发病率很低的疾病 D .设计的要求高,实施复杂 E.不能计算发病率、死亡率等 属于实验流行病学方法的有( A/C ) A .临床试验 B.普查 C.社区试验 D.队列研究 E.个体试验 反映诊断试验可靠性的指标是( E) A .灵敏度 B.特异度 C.约登指数 D.阳性似然比 E.符合率 为提高诊断试验的灵敏度, 对几个独立试验可(B ) A .串联使用 B.并联使用 C.先串联后并联使用 D .要求每个试验假阳性率低 E.要求每个试验特异度低 某病早期治疗效果好,漏诊后果严重,对此病的试验诊断应(A ) A .提高灵敏度 B.提高特异度 C.降低诊断的截断值 D.提高阳性预测值 E.提高阴性预测值 诊断试验的真实性是指(A ) A .被试验的测定值与实际值的符合程度 B.是重复试验获得相同结果的稳定程度 C .是观察者对测量结果判断的一致程度 D.是试验结果表明有无疾病的概率 E.指病例被试验判为阳性的百分比 流行病学是研究疾病、健康状态和事件在人群中的分布、影响和决定因素,用以预防科控制疾病、促进健康的学科。 流行病学研究的方法: 观察性研究 实验性研究 理论性研究 观察性研究: 描述性研究 (横断面研究(现况调查)比例死亡比研究 生态学研究) 、 分析性研究 (病例对照研究 队列研究(随访研究)) 实验性研究:临床实验、现场试验、社区干预试验和整群随机试验 理论性研究:流行病学方法研究理论流行病学 比例:是表示同意事物局部与总体之间数量上的比值,分子和分母的单位相同,且分子包含于分母之中。(构成比) 某医院住院病人中有15%的胃癌患者,该15%是: A. 患病率 B.发病率 C.构成比 D.相对比 例:某病患者409人,其中男性170人,女性239人,男女性构成比见右侧表所示。具体计算: 表 409名患者性别构成 男性患者数 男性构成比=⨯100% 男女性患者总数170 =⨯100%= 170+239 构成比的特点是各组成部分的构成比之和为100% 例如,某年某地出生婴儿中,男性婴儿有185人,女性婴儿有176人,则: 出生婴儿性别比= 男性婴儿数女性婴儿数 = 185176 = .比或相对比:是两个相关指标之比,说明两指标间的比例关系。两个指标可以是性质相同,如不同时期发病数之比;也可以性质不同,如医院的门诊人次与病床数之比。常用倍数或百分数表示。 两指标可以是绝对数、相对数或平均数。 相对比= 甲指标 ⨯100%)乙指标 3.率:表示一定时间内,实际发生某现象的例数与可能发生该现象的总例数之比,用以说明某现象发生的频率或强度,常用百分率(%)、千分率(‰)、万分率(1/万) 或十万分率(1/10万)等表示。 率= 说明某现象发生频率或强度的相对数是 某现象实际发生的例数 ⨯k 可能发生该现象的总例数 A. 率 B.构成比 C.相对比 D.百分位数 发病率 发病率= 一定时期内某人群某病新病例数 ⨯k 同期暴露人口数 用途:反映该病的风险。用来描述疾病的分布、探讨发病因素、提出病因假设、评价防治效果 1.描述疾病的发病率指标,计算时分子应为 A .新发病例数 B.新旧病例数 C.受检者中阳性人数 D.易感接触者中发病人数 2.发病率的分子是 A .患病人数之和 B.新病人数之和 C.感染人数之和 D.死亡人数之和 1. 描述疾病的患病率指标,计算时分子应为:B A. 新发病例数 B.新旧病例数 C.受检者中阳性人数 D.易感接触者中发病人数 2. 患病率:又称现患率或流行率。 患病率= 特定时间点某人群中某病新旧病例数 ⨯k 同期观察人口数 K=100%,1000‰,10 000/万或100 000/10万 时点患病率:调查时间一般在1个月内 期间患病率:调查时间超过1个月 影响因素:患病率=发病率×病程 用途:患病率通常用来描述病程较长的慢性病发生或流行情况 黄炳率与发病率的区别 1. 死亡率:指某人群在一定期间内(1年)死于所有原因的人数在该人群中所占比例。 K=1000或100 000/10万 死亡率= 某时期内死亡总数 ⨯k 同期平均人口数 2. 病死率:在一定时间内患某病的全部患者中因该病而死亡的比例。多用于病程短的急性病。表明疾病的严重程度。 病死率= 某时期因某病死亡的人数 ⨯100% 同期患某病的人数 3. 生存率:又称存活率。指患某病的人(或接受某种治疗措施的患者)经n 年随访,到随访结束时仍存活的病例数与随访病例的总数之比 n年生存率是评价慢性、病死率高的疾病远期疗效的重要指标。 n 年生存率= 1. 相对危险度(RR )或率比:指暴露组发病率与非暴露组发病率之比。反映了暴露于疾病的关联强度。RR= Ie/I0 RR=1,暴露与疾病无联系 RR1,暴露与疾病存在正联系(暴露是危险因子) 例:Doll 和Hill 调查了英国35岁以上男性吸烟习惯与肺癌死亡率的关系,不吸烟人群的肺癌死亡率为‰,中度吸烟者(15-24支/日)的肺癌死亡率为‰。RR= 说明吸烟者死于肺癌的危险性是不吸烟者的倍。 2. 比值比(OR ):又称优势比、交叉乘积比。指病例组中暴露人数与非暴露人数的比值除以对照组中暴露人数与非暴露人数的比值。 发病率(死亡率)很低;研究对象代表性好—— OR≈RR 归因危险度(AR )或率差(RD ):是指暴露组发病率与非暴露组发病率之差,反映发病归因于暴露因素的 随访满n 年后仍存活的病例数 ⨯100% 随访满n 年的该病病例数 程度。AR= Ie-I0 =RR×I0-I0 =I0 (RR-1) AR 意义:暴露者中完全由某暴露因素所致的发病率或死亡率。 例:AR=‰‰=‰。表明在每日吸15-24支香烟当中由于吸烟所致的肺癌死亡率为‰ 归因危险度百分比(AR%):指暴露人群中有暴露因素引起的发病在所有发病中所占的百分比。 AR%= (Ie-I0)/Ie×100% 例:AR%=()/×100%= 表示在每日吸15-24支香烟者中有的肺癌是由吸烟所致。 现况调查:在某一人群中应用普查或抽样调查等方法收集特定时间内有关变量、疾病或健康状况的资料,以描述目前疾病或健康状况的分布及某因素与疾病的关联。 现况调查的种类 (!)普查:指在特定时间内,对特定范围人群的每一个成员所进行的调查,也称全面调查。 (2)抽样调查:是从总体人群中随机抽取有代表性的一部分人(样本)进行调查,以样本结果来估计总体人群的疾病或健康状况的一种调查方法。 抽样方法:非随机和随机抽样 现况调查优缺点 (1)优点:研究结果有较强的推广意义;可形成同期对照;是病因探索中的基础性工作 (2)局限性:难以确定心因后果;不能获得发病率资料;有可能低估患病水平 队列研究的原理是将特定的人群按其是否暴露于某因素或按不同暴露水平分为n 个群组或队列,追踪观察一段时期,比较两组或各组发病率或死亡率的差异,以检验该因素与某疾病有无因果联系及联系强度大小的一种观察性研究方法。 1. 队列研究主要用于: A .研究发病机理 B.研究职业种类 C .验证某种暴露因素对发病率或死亡率的影响 D.研究个体基因突变性 队列研究的特点: 时序是前瞻性研究 观察性对比研究 暴露组否分组 研究方向由“因”推“果” 追踪观察的两组间的发病率或死亡率差异,RR=[a/(a+b)/[c/(c+d)] 1. 队列研究的特点有 A. 属于观察法√ B.属于实验法 C.设立对照√ D.研究方向由因推果√ E.研究方向由果追因 队列研究的优缺点: (1)优点: 研究对象在疾病发生前按暴露情况分组且进行随访,所获资料完整可靠,无回忆偏倚可直接计算发病率或死亡率,因而能计算相对危险度和特异危险度等指标,直接估计暴露于疾病的联系强度大小可同时研究一种因素与多个疾病的关系, 有助于了解疾病自然史。暴露因素与疾病的时间先后顺序清晰,因此论证因果关系的 能力强。暴露因素的作用可分等级,便于计算剂量-效应关系。样本量大,结果较稳定。在有完整资料记录的条件下,可做回顾性历史队列研究。 (2)局限性: 观察时间长,费人力、费钱,不能在较短时间内得到结果;准备工作繁重,设计的科学性要求高,实施难度大。暴露人年计算工作量较为繁重。不适于研究发病率很低的疾病。由于随访时间长,所以容易产生失访偏倚 多选 1. 队列研究的用途有( ) A. 用于验证某种暴露因素对发病率的影响 B.用于传染病发病机理研究 C.用于检验职业人群 D. 用于人群干预研究 E.描述疾病的自然发展过程 病例对照研究: 选择患有所研究疾病的患者作为病例组,同时选择未患该病的人作为对照组,调查两组人群发病前对某个(些)因素的暴露状况,比较两组暴露率和暴露水平的差异,以研究该疾病与这个(些)因素的关系。 病例研究的优点 1. 在疾病发生后进行,研究开始时已有一批可供选择的病例 2. 研究对象按发病与否分成病例组与对照组 3. 研究因素的暴露状况是通过回顾获得的 4. 由果及因的推理顺序 5. 比较两组暴露率或暴露水平,分析暴露于疾病的联系。OR=ad/bc 1. 病例对照研究的因果顺序是:c A .由因追果 B.由因追因 C.由果追因 D.由果追果 2. 病例对照研究在时间上属于: b A. 现况性研究 B.回顾性研究 C.前瞻性研究 D.回顾加前瞻性研究 实例 目的:A 型性格与冠状动脉病变的关系 研究对象: 病例组:经冠状动脉造影确诊的冠心病患者 对照组: 医院对照(内对照):冠状动脉造影正常+ECG平板运动试验阴性的其他科室住院者 人群对照(外对照):中型企业健康普查人群完全随机抽样( ECG平板运动试验阴性) 信息采集: 信息采集: A 型性格:全国冠心病与A 型行为类型协作组1985年制定的《A 型性格问卷》,按确诊冠心病前两年的情况 其他危险因素:一般人口学特征,既往高血压、高血脂等心血管疾病史及家族史,烟酒及膳食习惯等。 冠状动脉病变指数:按造影所示病变部位及支数、狭窄程度及范围,结合美国心脏病协会规定的节段法进行评判。 研究对象例数:实际分析339人 病例组139人 医院对照83人 人群对照117人 主要结果: 病例组与医院和人群对照组之间在年龄、性别、居住地及工作年限、职业构成等方面经检验,均无显著性差异,说明各组间可比性较好 A 型性格发生冠心病的危险性: 男性:OR 值(95%CI:) 女性: OR值(95%CI:) 性格评分等级与冠状动脉病变的关系:呈明显剂量-效应关系 控制和调整了各因素的混杂后,A 型性格与冠状动脉病变的发生依然密切相关 表6-2 性格类型与冠状动脉疾病程度间关系的对比分析 实验性研究:又称干预研究,基本性质是研究者在一定程度上掌握着实验的条件,主动给予研究对象某种干预措施。 主要类型:临床试验、现场试验、社区试验、类实验 实验研究的特点: 1. 前瞻性研究:干预在前,效应在后 2.随机分组: 3. 设立对照组:来自同一总体 4.有干预措施:容易产生伦理学问题 临床试验是按实验法,运用随机分配的原则将试验对象分为试验组和对照组,给实验组某种治疗措施,不给对照组该措施或给予安慰剂(placebo ),经过一段时间后评价两种措施产生的效应,从而评价临床治疗、 预防措施的效果和进行病因研究。 诊断指标: 客观指标:仪器测定指标 主观指标:患者主诉 半客观指标:诊断者的主观感知(肿物的硬度、大小) 诊断标准:生物统计学方法、临床判断法、ROC 曲线法 真实性:有效性、效度或准确性。是指待评价试验所获得的测量值与实际情况(金标准测量值)符合程度。 灵敏度(真阳性率) 特异度(真阴性率) 误诊率(假阳性率) 漏诊率(假阴性率) 似然比 正确诊断指数 练习题 提高诊断试验灵敏度的办法是( ) A. 串联试验 B.并联试验 C.先串联后并联 D.先并联后串联 筛检试验:通过快速的检验、检查或其他措施,将可能有病但表面上健康的人,同那些可能无病的人区分开。 筛检的主要用途: 早发现临床前期的可疑患者(二级预防) 发现高危个体(一级预防) 流行病学监测 了解疾病的自然史 小王是北京海淀区万寿路社区卫生服务中心的一名健康管理师,需要针对本社区老年常见慢性病患者进行健康管理,计划两年之内增加高血压、糖尿病等的检出率、建档率和随访干预覆盖率,五年之内减少因高血压、糖尿病发病和死亡等指标,那么他应该从什么地方开始动手呢? 该小区人群一般人口学特征(如年龄、职业、婚姻状况、性别等)情况如何分布? 该小区人群常见慢性病(高血压、糖尿病、周围血管疾病、冠心病等)患病率如何? 影响这些慢性病患者的危险因素有哪些?如何进行干预? 社区中高血压、糖尿病患者的远期心血管病(主要是冠心病和脑卒中)发病和死亡风险如何,怎样预测?在进行12个月的干预后,如何评价效果?
去知网找,那里肯定有你要的论文,自己可以先搜搜看,不知道怎样找的话,可以去我百度空间里,有如何在网络上找论文的文章介绍
我来帮帮你大哥风范复合化肥 大哥你也真是,咋在这做广告来了,,你看你,这题目可是关于医学论文的。你怎么做广告也不看地方。真是浪费发帖者的心血。。哎!可悲啊!
一、统计方法在医学中的应用有:1、明确研究目的和研究设计正确的统计学分析一定要建立在明确的研究目的和研究设计的基础之上,那些事先没有研究目的和研究设计,事后找来一堆数据进行统计分析都是不可取的。 在医学论文的撰、编、审、读过程中经常遇到的问题是研究的题目与课题设计、论文内容不符,包括文章的方法解决不了论文的目的、文章的结果说明不了论文的题目、文章的讨论偏离了论文的主题;还有是目的不明确、设计不合理。如题目过小,论文不够字数,而一些无关紧要的变量指标或结果被分析被讨论;又如题目过大,论文的全部内容不足以说明研究的目的,使论文的论点难以立足。 所以,合理明确的论文题目或目的以及研究设计方案是撰、编、审、读者应当关注的首要问题。此外,样本含量是否满足,抽样是否随机,偏倚是否控制等,也是不可忽视的问题。2、建好分析用的数据库建好数据库是正确统计分析的前提和基础,甚至决定了论文分析结果的成败。对于编、审、读者来讲,一般由于篇幅的限制,往往得不到数据库数据,而只有作者在数据库数据基础上经统计描述计算后给出的诸如各指标均数 x、标准差 s 或中位数 M、百分位数 Px 的“二手”数据,或将研究对象的某一指标按其数值大小或特征属性分组,清点各组观察单位出现的个数或频数的频数表数据等。 无论是否能够得到数据库数据,作者在统计分析过程中一定依据数据库数据进行计算,得出结果。如果对“二手”数据或频数表数据的结果等存在疑惑,编辑、审稿专家或读者有权要求作者提供数据库数据以检查其完整性、准确性和真实性,确保研究数据的质量。假若在投稿须知中对数据库数据作出必要的要求,无疑对于保证刊物的发表质量有着积极的意义3、分清楚指标(或变量)的性质和类型很多研究表明,掌握好统计分析的应用条件,正确选择统计分析方法是学习并应用统计学的一个突出难点。 对于医学论文作者而言,分清楚数据库中变量的性质(影响变量与结果变量)、类型(数值变量、多项有序分类变量、多项无序分类变量、二项分类变量)以及它们之间的降级转化关系(数值变量一多项有序分类变量一多项无序分类变量一二项分类变量)是学好用好应用统计分析的基础,可以有效避免张冠李戴、缺乏原则地选错统计分析方法;对于文章的编审和读者来说,这是判断作者正确选择统计学分析方法与否的一个简单有效的途径。二、常用的统计分析软件:统计分析软件是统计分析的必备工具,常用的统计分析软件有:统计分析系统 SAS、社会学统计程序包 SPSS、微软公司电子表格系统 Microsoft Office Excel 等。
医学论文统计学分析的知识你可以登陆:创新医学网 创新医学网上有医学论文统计学分析视频、医学论文写作辅导范文、医学论文写作视频、医学论文写作电子书等等,统计学分析的所有信息创新医学网上有很多资料,都是可以查看的。 卫生统计在医学期刊中占有非常重要的地位。任何科研设计、实验研究都离不开统计方法,而统计方法的正确与否直接影响到论文的质量。我们在编审稿件过程中,经常遇到统计学方法使用不当等问题。 数理统计的基础是概率论,对统计分析的资料下结论的依据是小概率事件在一次试验中是不可能发生的。一般统计上习惯把概率P≤或P≤认为是小概率事件[1]。当通过假设检验(显著性检验)获得P>时,认为是大概率事件,说明在这一次试验中很可能发生,因此接受假设,认为差异无显著意义(差异不显著)。