版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、医学统计学(1)第一临床医学院临床评价分析中心季聪华中医药统计学一、绪论二、统计描述三、概率分布四、参数估计与假设检验五、t检验六、方差分析七、双变量相关与回归分析八、x2检验九、基于秩次的非参数检验十、实验设计十一、调查设计十二、协方差分析十三、多重线性回归分析十四、logistic回归分析十五、生存分析十六、聚类分析和判别分析十七、主成分分析与因子分析十八、Meta分析第一部分 绪论第二部分 SPSS基本操作第三部分 Epidata基本操作第一部分 绪论天气预报生活中的统计学投机取巧投机取巧统计是以数据为食物的动物 统计的本业是消化数据,并产生有营养的结果。它的本质,和母牛相差不多。 Da
2、ta Statistics Information GrassCowMilk现实意义 统计学是科研和论文过程中最核心的方法学!定 义统计学( statistics )是关于数据的学问,是一门从数据中提取信息、知识的科学与艺术,包括研究设计、收集资料、整理资料、分析资料和结果报告等步骤。Statistics is the science dealing with the collections, analysis, interpretation and presentation of masses of numerical data.(Webster 国际大词典)Statistics is th
3、e science and art of dealing with variation in data through collection, classification and analysis in such a way as to obtain reliable result. 不列颠百科全书 方法的类型研究和应用程度统计学理论统计学应用统计学描述统计学推断统计学理论统计学(theoretical statistics):即数理统计学(mathematical statistics),主要探讨统计学的数学原理和统计公式的来源。它把研究对象一般化、抽象化,以概率论为基础,从纯理论的角度,
4、对统计方法加以推导论证,其中心内容是统计推断问题,其实质是以归纳方法研究随机变量的一般规律。应用统计学(applied statistics):是数理统计学的原理方法在不同学科领域中的具体应用。例如,数理统计学在生物学中的应用形成生物统计学(biostatistics);在医学中的应用形成医学统计学(medical statistics)、卫生统计学(health statistics)和中医药统计学(statistics for traditional Chinese medicine)。统计学的发展有 4 个明显趋势随着数学的发展,统计学吸收和运用的数学方法越来越多。统计方法与计算机技术相
5、结合,已渗透到所有的学科部门,以统计学为基础的边缘学科不断形成。统计与实质性学科、统计软件、现代信息相结合,所发挥的功效日益增强。统计学的作用与功能已从描述事物现状、反映事物规律,向抽样推断、预测未来变化的方向发展,己成为具有方法论性质的综合性学科。统计学的基本思想、研究方法和特点统计学的基本思想:可归纳为变异的思想、概率的思想和随机抽样思想。统计学的研究方法:统计学的基本研究方法是由观察到的个体特征归纳推断总体某种特征的归纳推理法。统计工作一般分为四个步骤,即:研究设计、收集资料、整理资料和分析资料。这四个步骤是密切联系、不可分割的,任何一个环节发生缺陷都会影响研究结果的质量及研究工作的成败
6、。统计工作的步骤及内容统计描述统计推断参数估计假设检验统计指标统计图表研究设计收集资料整理资料分析资料一、研究设计研究设计( research design )就是拟订一份科学合理的总体计划,围绕研究目的将有关的研究方法与步骤的纲目拟订出来,用以保证取得一个较为客观的研究结果。完善的研究设计可把误差减少到最低程度,并能比较准确地估计误差大小,还可将多种处理因素合理地安排在一个实验中,提高研究效率,用较少的人力、财力、物力和时间,最大限度地获得丰富可靠的资料。研究设计包括实验设计、临床试验设计和调查设计,这三者均涉及专业设计与统计学设计,其内容一般包括:研究目的、步骤、受试者的选择、处理的拟定、
7、观察指标、项目和方法等。1 .专业设计( specialized design)用什么方式、方法来验证假说或回答有关的专业问题。其目的在于保证研究成果的实用性、可行性和创新性。(具体的专业人员做)2 .统计学设计( statistical design )如何合理地安排实验内容,对实验结果如何进行有效地分析。其目的在于保证结果的经济性、可重复性和科学性。(统计人员做,研究生自己要能做)一般情况下,有什么样的研究设计,就跟着什么样的实验或试验,就有适当的统计分析方法相对应。科研工作者一定要树立设计优先的思想,只有缜密、完善的研究设计,才能获得真实可靠的研究结果。二、收集资料收集资料( data
8、collection )是指根据研究目的,按照设计要求去准确、及时和完整地收集原始资料。资料来源与要求如下:1.日常医疗工作记录和报告卡医院各科门诊病历、住院病历、健康检查记录、各种医疗检查记录等都是统计工作最宝贵的原始材料,它们是医学观察和实践经验的真实体现,许多疾病发生、发展、诊治的规律等大量信息均隐藏在这些记录之中,它可大大节约调查的人力与经费,而且在某些情况下登记误差很小。2.统计报表:医疗工作统计报表是国家取得系统的统计资料的一种形式。它具有统一的表式、统一的指标和统一的报送时间和程序,是由各级医疗保健机构根据国家规定,定期逐级上报的。它是拟定医疗保健工作计划与措施,检查与总结工作时
9、的科学依据,也是科学研究的基础资料。例如,反映医院门诊与住院两方面工作量和医疗质量的指标有:门诊人次数,急诊人数,各科门诊工作量与比重,门诊患者疾病构成情况,住院患者疾病的构成、治愈率、好转率、病死率,床位使用情况,病历书写情况。医院基本建设情况,医院教育、科研情况等。(管理类研究较常用)4.其他来源:统计分析所需要的数据有时可来自公共或共享资料,如可取自官方或人民团体机构发布的医疗卫生服务调查、研究分析的统计汇总资料、公开发表的有关报告、商业性数据库以及专题研究文献等。比如:meta分析就是利用已有的文献资料进行研究。三、整理资料整理资料(sorting data)是把收集到的原始资料,有目
10、的、有计划地进行科学的加工(如分组或汇总),使其系统化、条理化,以便更好地揭示所研究事物的规律性,有利于统计分析。它包括以下步骤:1.资料核查:首先检查原始记录,对错记或漏记记录,要及时纠错补漏;其次是标记可疑值,必要时对可疑值重新观测。四、分析资料分析资料( analysis data )即统计分析,主要包括统计描述( statistical description )与统计推断( statistical inference )。统计描述是指用适合资料性质的统计指标、统计图表等,对资料的数量特征及其分布规律进行表达,以反映变量值的水平、频率、联系强度。统计推断是通过抽样研究,根据样本资料所提
11、供的信息,对未知总体做出具有一定概率性的估计和推断,包括参数估计和假设检验两方面。医学生在进行中医药研究中,对资料的统计分析可以借助专门的计算机统计软件,依照操作程序输人数据和选用正确的统计分析方法,由计算机快速、准确地进行数据统计分析,并制作出相应的统计表和统计图 。医学统计学定义统计工作的基本步骤统计指标分类统计学几个基本概念一、变量与变量值变量( variable )是指观察单位的某研究特征,反映个体观察值间参差不齐的现象(即变异),其测定结果称为变量值(value of variable)或观察值。例如,患者的呼吸、脉搏、体温和血压等,中医脉诊中患者的不同脉象等。观察测量的对象不同,得
12、到的结果(值)不同。例如,每个患者的血压测定结果就称为血压变量值,简称为血压值。根据变量的不同观察结果,将变量分为数值变量和分类变量。1.数值变量(numerical variable)又称定量变量(quantitative variable)或计量变量(measurement variable),是由仪器、工具或其他定量方法测定的某项指标。它可以是连续变量也可以是离散变量。在某一区间可取任何值的数值连续变量:如身高(cm)、体重(Kg)、血压(kPa)等;在某一区间只可取有限的几个值的数值离散变量:如家庭人口数、脉搏(次/分)等。2.分类变量(categoncal variable)又称定性
13、变量(qualitative variable)或计数变量(count variable),是将事物按不同的属性归类,清点每一类中包含的个数,反映事物属性与类别的指标。它分为二分类变量与多分类变量,后者又分为有序多分类变量与无序多分类变量。(1)二分类变量:指变量的观察结果只有相互对立的两种情况。例如:检验结果分为阳性、阴性, 性别变量分为男性、女性, 中医面色分为常色、病色等。(2)多分类变量:指变量的观察结果表现为多种情况,有以下两种类型:有序多分类变量:即等级变量,归类的组别之间有程度或等级上的差别。如: 疗效表现为无效、好转、有效、痊愈 患者的某种疾病特征用“+”号的个数来表示其不同程
14、度,如患者尿糖情况分为一、+、+、十+等。无序多分类变量:分类变量的观察结果表现为不同的属性特征。 如中医苔色表现为白苔、黄苔、灰黑苔:婚姻状况分为未婚、已婚、离异、丧偶、再婚;血型分为 A 、B 、O 、AB型;职业分为:工人、农民、商人等。二、变量转换根据研究的需要,有时可将分类变量转换成数值变量,数值变量变为分类变量。1.分类变量转换成数值变 量(1)二分类变量的转换:用0与1表示。 男性=1,女性=0 有效=1,无效=0 有=1,无=0(2)多分类变量的转换:无序多分类变量:需要构造哑变量,哑变量也称标识变量,它是二值变量。一般按如下方式构造哑变量:某一个无序多分类变量有 m 个水平,
15、需引人 m - 1 个二值的哑变量,并以其中之一为基准。哑变量的最终结果无论有无统计学意义,都是相对于基准而言的。哑变量ABABOX11000X20100X30010无序多分类构造哑变量有序多分类变量:在构造哑变量方面同无序多分类变量,也可以不构造哑变量,用 0 ,1 , 2 ,依次代表不同水平,达到分类变量转换成数值变量的目的。哑变量文盲小学中学大学X11000X20100X30010变量文盲小学中学大学X0123有序多分类构造哑变量有序多分类不构造哑变量2.数值变量转换成分类变量年龄分类表示1840岁以下01940岁以下02040岁以下02640岁以下03240岁以下04340岁以上145
16、40岁以上15440岁以上15640岁以上17040岁以上13.数值变量间的转换对数转换平方根转换倒数转换。资料类型的判断病例号年龄性别身高血型心电图尿WBC职业135女1.65A正常教师244男1.74B正常工人326男1.80O正常职员425女1.61AB正常农民541男1.71A异常+工人645女1.58B正常+工人750女1.60O异常+干部828男1.76AB正常+干部931女1.62O正常军人三、统计资料的分类统计资料由变量及其观察值组成,统计资料的分类与统计变量的分类相对应。1.数值资料(numerical data)是反映数值变量的资料,又称定量资料(quantitative
17、data)或计量资料 (measurement data)。例如,测量100名男大学生的身高所获得的资料就是数值资料。这类资料的统计描述有集中趋势与离散趋势,统计分析方法有t检验、u检验、方差分析、秩和检验、若干种多元统计分析等。2 .分类资料( count data )是反映分类变量的资料,也称为定性资料( qualitative data )或计数资料( count data )。它分为二分类和多分类资料,多分类资料又分为有序和无序多分类资料,有序多分类资料又称等级资料( ordinal data )。将 100 名男大学生按性别分组:男 53 例,女 47 例,此资料就是二分类资料;按血
18、型分组: A 型 39 例、 B 型 20 例、 o型 17 例、 AB 型 24 例,此资料就是无序多分类资料。用某中药治疗某种疾病患者 50 名,按临床疗效分为痊愈 22 例、显效 12 例、好转 5 例、无效 5 例、恶化 6 例,此资料就为有序多分类资料或等级资料。分类资料的统计描述常用相对数,统计分析方法有x2检验(卡方检验)、u检验、秩和检验、部分多元统计分析等。医学统计学定义统计工作的基本步骤统计指标分类统计学几个基本概念一、同质与变异1.同质(homogeneity)指观察单位间影响研究指标的因素相同。由于研究指标的影响因素往往难以完全控制,甚至未知,因此在实际工作中观察单位的
19、同质是指对研究指标的影响较大的、可以控制的主要因素相同或基本相同。如研究某地区儿童的身高,则要求影响身高这一指标的主要因素(如年龄、性别、民族)要相同,而不能控制的因素(遗传、营养等)可不要求相同。同质是研究的前提条件,同质是相对的,对于身高指标,成年男女有别而不同质;而对于脉搏指标,成年男女无别而同质。同质是一范畴,是纳入和排除对象的标准。临床研究课题的纳入、排除标准设置的目的就是研究对象同质的需要。2.变异(variation)指在同质的基础上各观察单位间某观察指标的差异。如同年龄、同性别、同民族、同地区儿童的身高间的差异,称为身高的变异。统计学研究的对象是具有变异的事物,统计学是处理变异
20、数据的科学,没有同质性就够不成一个总体供人们研究,没有变异就无需统计学。二、总体与样本1.总体( population )是根据研究目的所确定的同质观察单位的全体。观察单位是指被研究总体中的某个单位,即个体。例如,描述某地 16 岁以上男性血脂水平,则该地所有 16岁以上的男性居民血脂的测量值就构成所描述的总体,而其中每个 40 岁以上的男性血脂测量值就是一个观察单位,即个体。总体随研究目的不同而所含的范围也不同。根据研究目的,有些总体中观察单位数是有限的或可知的,称为有限总体。有些总体的观察单位数是无限的或不可知的,称为无限总体。对无限总体中每个个体逐一考核是做不到的,对观察对象具有危害与损
21、伤的总体中每个个体逐一考核是不允许的,对个体数量很大的有限总体逐一考核需花费较多的人力、物力和时间。所以,对总体特征与性质的认识一般情况下不是采用逐一考核每个个体的方法,而常采用抽样研究。2.样本(sample)是从总体中随机抽取的具有代表性的个体的集合。抽样研究(sampling study)是从总体中抽取样本,通过样本的定量或定性测量结果来推断总体。抽样研究的目的是用样本的特征正确地、可靠地推断总体的特征,所以样本必须对总体具有良好的代表性。图示:总体与样本populationsample2sample1sample3sample4 sample5抽样研究应注意如下几点:(1)样本含量足够
22、大。样本含量指样本所包含的观察单位数(即样本例数),统计学中常用n表示。研究资料的变异程度大小、研究方法、研究结果精确性等决定样本含量。(2)遵循随机抽样原则。随机抽样是指从研究总体中按一定的概率抽取部分观察单位的方法。随机不是随便或随意,随机是指研究总体中每个观察单位被抽到样本中的机会均等。统计学中常用的随机抽样方法有单纯随机抽样、系统抽样、分层抽样和整群抽样,在进行大规模的流行病学调查时,还结合使用以上4种抽样方法,把抽样过程分为不同阶段进行,称多级抽样。(3)样本的构成分布应基本上与总体构成分布保持一致。 三、参数与统计量反映总体的统计指标称为参数(parameter),用希腊字母表示,
23、如(总体算术均数)、(总体标准差);反映样本的统计指标称作统计量(statistics),用拉丁字母或英文字母表示,如x(样本均数)、s(样本标准差)。总体样本抽取部分观察单位 统计量 参 数 估计 四、误差误差(error)泛指观测值与真实值之差以及样本统计量与总体参数之差。其主要分为非随机误差与随机误差。非随机误差包括系统误差和过失误差,随机误差包括随机测量误差和随机抽样误差。1.系统误差(systematic error)是指在实际观测过程中,由受试对象、研究者、仪器设备、研究方法、非实验因素影响等原因造成的有一定倾向性或规律性的误差。流行病学称之为偏倚(bias)。例如,仪器初始状态未
24、调整到零,标准试剂未经校正所致的误差。其特点为:观察值有系统性、方向性、周期性的偏离真值,可以通过严格的实验设计和技术措施消除。2.过失误差(gross error)由于观察过程中不仔细而造成的错误判断或记录。研究中应认真检查核对,否则将会影响研究结果的准确性。这种误差实际上是错误,应该避免。比如:点错小数点3.随机测量误差(random measurement error)是指各种偶然因素(如电压、环境温度等)的影响造成同一对象多次测定的结果不完全一样,或同一样品由不同观察者观测所造成的差异。该误差不可避免,但要控制在允许范围内。提高操作者熟练程度可以减少这种误差。4.随机抽样误差(rand
25、om sampling error)简称抽样误差(sampling error),是由于随机抽样所引起的样本统计量与总体参数间的差异以及各样本统计量之间的差异。医药现象的变异总是客观存在的,因而在抽样研究中,抽样误差总是不可避免的,但它有一定的分布规律,是可估计、可控制的。样本对总体的代表性越好,抽样误差越小,反之,样本对总体的代表性越差,抽样误差越大。五、概率若在相同条件的控制下对某试验进行n次重复,一个事件出现的次数m和总的试验次数n之比,称为这个事件在这n次试验中出现的频率(frequency)。当试验次数n很大时,该频率将趋近于一个较稳定的常数,这个常数即该事件发生的概率(probab
26、ility)。概率是反映随机事件发生的可能性大小的度量,用p表示,取值范围为0P1。随机事件的概率为0P1 ;必然事件的概率等于1,即P(u)=1;不可能事件的概率等于0,即P(v)=0。某事件发生的概率愈接近于1 ,表示该事件发生的可能性越大;反之,愈接近于0,表示该事件发生的可能性越小,统计学通常把P0.05或P0.01的随机事件称为小概率事件。小概率事件虽不是不可能事件,但一般认为小概率事件在一次试验中是不大可能发生的,这就是小概率原理,小概率原理是统计推断的一条重要原理。小概率事件在一次试验中是不会发生的。如何学好统计学思想重视观念正确方法得当 不纠结于原理,不死记公式,善于使用工具,
27、善于学习案例。第二部分 SPSS基本操作SPSS(Statistical Package for Social Science),社会科学统计软件包;1968年美国斯坦福大学的学生开发了最早的版本;1975年在芝加哥合伙成立了SPSS公司;1994-1998年期间,收购了多家公司,成为一家走在了最新流行的“数据挖掘”和“数据仓库”领域前沿的综合统计软件公司;SPSS(Statistical Product and Service Solutions),统计产品与服务解决方案;目前,已被IBM公司收购.SPSS软件安装SPSS17.0在win XP win7操作系统都可以安装只要跟着提示,一直下
28、一步就可以SPSS的基本功能定义变量数据的输入与保存数据的编辑变量的操作数据文件的合并和分组读入其他格式文件数据SPSS的功能介绍SPSS几乎可以做医学统计的所有事情科研设计:随机分组表、交叉设计、抽样方案统计分析:几乎所有统计方法数据挖掘:高端模块、被IBM收购后,有了较好的市场开拓。数据管理:数据录入、高端模块有基于网络的数据录入。SPSS使用前的1项准备:语言设置SPSS的2个窗口(视图)数据视图变量(定义)视图SPSS的3种文件数据文件:保存原始数据(*.sav)语法文件:程序语句文件(*.sps)输出文件:保存分析结果(*.spv)SPSS使用的4大技能会正确排列原始数据会便捷处理变
29、量、文件会选择统计分析方法会阅读使用统计结果原始数据的排列一个列对应一个变量,即每一列代表一个变量(Variable)或一个被观测量的特征。例如问卷上的每一项就是一个变量。每一行代表一个个体、一个观测、一个样品,在SPSS中称为事件(Case)。例如,问卷上的每一个人就是一个观测。单元包含值,即每个单元包括一个观测中的单个变量值。单元(Cell)是观测和变量的交叉。数据文件是一张长方形的二维表。定义变量变量名必须以字母、汉字或字符开头,其他字符可以是任何字母、数字或_、#、¥等符号。我们推荐字母与数字的结合。变量总长度不能超过20个字符(即10个汉字)变量名必须唯一,不能有两个相同的变量名。变
30、量名不区分大小写。SPSS保留字不能作为变量名称,如ALLANDWITHOR等。尽量使用数值型占用资源最少能分类、能计算字符型也非常常用加显逗号的数值型变量标签是对变量名的进一步描述,变量只能由不超过20位的字符组成,而不足以表示变量的含义。变量标签可长达120个字符,可显示大小写,需要时可用变量标签对变量名的含义加以解释。变量值标签:是对变量的每一个可能的取值进一步描述,当变量是定性或定序变量时,是非常有用的。度量:表示数量大小的变量,如身高、体重等。有序:有序变量、等级变量,它取值的大小能够表示观测对象的某种顺序关系,也是基于“质”因素的变量。名义:定性变量,测量精度最低、最粗略的基于“质
31、”因素的变量,它的取值只代表观测对象的不同类别。数据的输入与保存变量定义好以后,在数据视图直接输入。如果在视图中的值标签勾上,则在录入带有变量值标签的数据时,用户手工输入的是实际的变量值,而屏幕显示的是与该变量对应的变量值标签。根据已有的数据进行计算使用“转换计算变量”菜单例如:尼莫地平法计算综合疗效、年龄分组等。数据的编辑数据查找增加和删除一个个案数据的排序选取个案子集缺失值的替代数据查找增加和删除一个个案定位到相应的行鼠标右击清除:删除一个个案插入个案:增加一个个案数据的排序选取个案子集全部个案:该选项用于解除先前的选择。如果条件满足:按指定条件选择。随机个案样本:对观察样本进行随机抽样。
32、通过条件公式、可结合函数表达式来定义选择个案的范围。数据视图显示:不被选择的个案的序号上被划上斜线,表示该个案不被纳入统计。对观察单位进行随机抽样缺失值的替代新生成一个变量缺失值产生的方法有多种,最常用的是序列均值变量的操作增加和删除一个变量指定加权变量建立新的变量变量重新赋值变量自动赋值增加和删除一个变量通过数据视图页面完成清除:表示删除插入变量:表示增加通过变量视图页面完成清除:表示删除插入变量:表示增加指定加权变量指定加权变量建立新的变量变量重新赋值变量自动赋值自动产生一个新的变量aa,按血清铜含量从小到大排序,aa为序号。数据文件的合并与分组数据文件的纵向合并数据文件的横向合并数据文件
33、的分组数据文件的纵向合并数据文件的纵向合并就是将一个SPSS数据文件的内容追加到数据编辑窗口当前数据的后面,然后将合并后的数据重新显示在数据编辑窗口中。通过该方法,可以将两个或更多个数据文件合并在一起。具体操作步骤:数据合并文件添加个案。数据文件的横向合并数据文件的横向合并就是将两个或两个以上的具有相同个案的数据文件连在一起。即将SPSS数据文件的内容连接到当前数据编辑窗口的右边,然后将合并后的文件显示在数据编辑窗口中。具体操作步骤:数据合并文件添加变量。数据文件的分组读入其他格式文件EXCELDBFTXT第三部分 Epidata基本操作数据获得及处理过程 研究设计资料收集资料整理资料分析质量
34、控制数据管理数据录入质控/核查数据转换/再整理Excel,EpiData, EDCSPSS, SAS, R, Stata 一、EpiData简介二、数据库的建立三、数据库的管理与维护四、数据库的输出与输入五、其他需要注意的问题一、EpiData简介免费的数据管理软件;下载地址 http:/www.epidata.dk 主要用于数据录入、核对、管理和数据报告。一、EpiData简介当前最高版本:Version 3.1 (2008) ;单机单用户系统,不受网络连接的限制;记录数最好不要超过200,000300,000条(Case), 整个录入界面不要超过999行(Variable) ;对数值或字符
35、串编码进行解释的文字长度最多80个字符,编码长度最多为30 个字符一、EpiData简介Epidata的特点: 直观方便 简单易学 实用性强 对计算机要求不高 数据录入、核查、转换功能强EpiData操作界面115菜单栏流程栏工具栏任务栏操作界面一、EpiData简介二、数据库的建立三、数据库的管理与维护四、数据库的输出与输入五、其他需要注意的问题二、数据库的建立2.1 建立调查表文件(*.qes)【定义调查表(问卷)的结构,即录入界面格式】2.2 创建数据库文件(*.rec) 【在这个文件当中可以录入数据并进行保存】2.3 建立核查文件(*.chk) 【定义字段输入数据的有效性】2.4 数据
36、录入118建立调查表之前的准备工作“选项”卡“文件”“选项”“选项”效果预览1QES文件字体背景建立调查表之前的准备工作“选项”卡“选项”效果预览2REC文件字体背景激活字段颜色非激活字段颜色建立调查表之前的准备工作“选项”卡 EpiData数据管理和录入流程 建立调查表文件创建数据库建立核查文件录入数据数据库管理输出数据2.1 建立调查表文件(*.qes)方法1(菜单栏):文件生成调查表文件(QES文件)方法2(流程栏):打开文件建立新QES文件方法3(工具栏):新纪录2.1 建立调查表文件(*.qes)中医临床诊疗指南应用评价调查问卷2.1 建立调查表文件(*.qes)1.纸质版:直接录入
37、修改2.电子版:复制粘贴修改2.1.1 设置变量名EpiData中使用两种变量命名方法: 以调查表中该项的第一个单词作为变量名 根据软件命名变量名的规则来自动命名变量名 2.1 建立调查表文件(*.qes)变量命名规则:变量名第一个字符一定为字母(A-Z) 之后可含字母(A-Z)和数字(0-9)变量名最多10个字符 变量名不能是中文 常用2.1 建立调查表文件(*.qes)字段名2.1.2 变量类型的选择选择设置:“字段编辑器”表示方法:数值型:#.# 字符型:_ (最多可以输入80个字符)日期型: 其他:逻辑:2.1 建立调查表文件(*.qes)2.1 建立调查表文件(*.qes)2.1 建
38、立调查表文件(*.qes)变量类型的选择字符型光标位置2.1 建立调查表文件(*.qes)变量类型的选择数值型光标位置2.1 建立调查表文件(*.qes)变量类型的选择日期型及其他2.1 建立调查表文件(*.qes)“预览”功能不生成数据文件展示数据录入时的调查表布局Check文件不起作用不能自动更新已经修改的调查表文件,需要重新点击预览2.1 建立调查表文件(*.qes)“预览”功能2.1 建立调查表文件(*.qes) EpiData数据管理和录入流程 建立调查表文件创建数据库建立核查文件录入数据数据库管理输出数据2.2 创建数据库文件(*.rec).rec文件的特点:根据.qes文件创立可
39、以直接打开默认与.qes文件同名,但不是必须的创建同名的数据文件将使已经存在的数据文件被删除并丢失如果只是修改数据文件,请使用相应的功能。2.2 创建数据库文件(*.rec)2.2 创建数据库文件(*.rec)2.2 创建数据库文件(*.rec)修改数据文件 修改已经录入数据的文件,使用“根据修改的qes文件更新rec文件”功能(Revise file)注意:如果没有qes文件可以根据数据文件生成改变字段(变量)或字段名(变量名)可能丢失数据。2.2 创建数据库文件(*.rec)不常用字段改变规则:所有字段可以改为字符型或大写字符型数值型可以改为相同位数或更高位数数值型,否则提示数据丢失整数可
40、以改为浮点型、加密字符型浮点型可以改为浮点型、加密字符型自动编码可以改为整数、 浮点型、加密字符型字符型可以改为加密字符型大写字符型可以改为加密字符型Soundex可以改为加密字符型日期型可以改为加密字符型2.2 创建数据库文件(*.rec) EpiData数据管理和录入流程 建立调查表文件创建数据库建立核查文件录入数据数据库管理输出数据2.3 建立核查文件(*.chk)EpiData 最简单的使用流程: 创建调查表文件(*.qes); 在调查表文件的基础上建立(生成)数据库(*.rec); 建立核查文件(*.chk) ,保证数据质量;在数据库(*.rec)中录入数据。 CHECK 的文件名必
41、须与数据库的文件名相同,唯一不同的就是扩展名;且必须保存在同一路径的同一文件夹下。2.3 建立核查文件(*.chk)目的:质量控制2.3 建立核查文件(*.chk)设置允许范围、允许值设置跳转功能设置为“必须录入”,“Yes”为必须设置为“重复录入”,“Yes”为与上一条重复。添加数值标签点击弹出编辑窗口2.3 建立核查文件(*.chk)基本CHECK 命令的设置Range, Legal“最小值-最大值”和(或)“值1,值2,值3, , 值N” (1-5 -INF-2 5-INF 4,6,8,10 2-6,8)IgnoreMissing忽略缺失值Jumps“跳转值1目标变量名1, 跳转值2目标
42、变量名2” (1V23,“2,3V40”,5end,6write AUTOJUMP V30)Must EnterYes/NoRepeatYes/NoValue Labels“数值+对应的文字解释”2.3 建立核查文件(*.chk)2.3 建立核查文件(*.chk)2.3 建立核查文件(*.chk)AFTER ENTRYAFTER FILEAFTER RECORDAUTOJUMPAUTOSAVEAUTOSEARCHBACKUPBEEPBEFORE ENTRYBEFORE FILEBEFORE RECORDCLEARCLEAR COMMENT LEGALCOLORCOMMENT LEGALCONF
43、IRMCOMMENT (*) CONFIRMFIELDCOPYTOCLIPBOARDDEFINEEXECUTE EXITGOTO HELPHIDE, UNHIDEIFTHENINCLUDE JUMPSKEYLABELLABELBLOCKLEGALLETMISSINGVALUEMUSTENTERNOENTERQUITRANGERELATEREPEATTOPOFSCREENTYPE TYPE COMMENT TYPE STATUSBARUNHIDEWRITENOTECheck命令:2.3 建立核查文件(*.chk)Check运算符和函数:运算符(Operators )算术运算符(Arithmeti
44、c Operators)逻辑运算符(Logical Operators)关系运算符(Relational Operators)函数(Functions )算术函数(Arithmetic Functions)字符串函数(String Functions )日期和时间函数(Date and Time Functions )其它函数2.3 建立核查文件(*.chk)算术运算符(Arithmetic Operators)运算符运算数据类型结果类型指数整数小数小数小数+加法整数整数小数小数字符串字符串-减法整数整数小数小数* 乘法整数整数小数小数/ 除法 整数整数小数小数div整数除法整数整数mod 余
45、数整数整数2.3 建立核查文件(*.chk)逻辑运算符(Logical Operators)运算符运算数据类型结果类型not否布尔逻辑布尔逻辑and和布尔逻辑布尔逻辑or 或布尔逻辑布尔逻辑xor异或 布尔逻辑布尔逻辑关系运算符(Relational Operators)运算符运算比较值比较类型=等于可比布尔逻辑不等于可比布尔逻辑大于可比布尔逻辑=大于等于可比布尔逻辑2.3 建立核查文件(*.chk)ABS(X)ARCTAN(X)COS(X)EXP(X)COUNTMISSING()FLOAT (X)FRAC(X)INT(X)INTEGER(X)LN(X)算数函数(Arithmetic Func
46、tions)PIPOWER(BASE, EXPONENT)RANGE(A,B,C)ROUND(X)SIN(X)SQR(X)SQRT(X)SUM()TRUNC(X)2.3 建立核查文件(*.chk)UPPER(S)LOWER(S)COPY(S)POS(SUBSTR;S)字符串函数(String Functions)LENGTH(S)STRING(X)SOUNDEX(S)日期和时间函数(Date and Time Functions)DATE(D, M, Y)DAY(D)DAYOFWEEK(D)MONTH(D)NOWNUM2TIME(D)TIME2NUM(F)TODAYWEEKNUM(D)YEAR
47、(D)其它函数ISBLANK、RECORDCOUNT、RECORDNUMBER EpiData数据管理和录入流程 建立调查表文件创建数据库建立核查文件录入数据数据库管理输出数据2.4 数据录入与直接录入不同的是 加入了质量控制功能2.4 数据录入2.4.1 在变量间转换 在数据录入过程中,激活下一个变量,可以使用 Enter、Tab 、键、或用鼠标直接点击目标变量。如果使用鼠标实现在变量间的跳转,则CHECK文件中设置的录入规则通常无效;因此常用Enter键完成跳转。如果变量允许录入的字符数全部录满,则光标会自动移到下一个变量,除非在CHECK 文件中设置了CONFIRM 命令。如果想回到上一
48、个变量,可以按Shift+Tab键,或键。按Ctrl+Home 键可以直接回到数据录入表格的第一个变量。选择Ctrl+End则可以直接跳转到最后一个变量。2.4 数据录入2.4.2 在记录间转换 1:移到第一条记录2:移到前一条记录(或Ctrl+PgUp ,或F7)3:移到下一条记录(或Ctrl+PgDn ,或F8)4:移到最后一条记录5:开始录入新记录(或Ctrl+N )6:删除记录或恢复一条删除的记录(或Shift+Delete) 非永久删除,误删的记录可以恢复也可以导出; 如需永久删除还需进行一下操作!1234562.4 数据录入永久清除记录2.4 数据录入2.4.3 查找记录 要寻找的
49、记录号已知 “查找”“定位记录” 2.4 数据录入2.4.3 查找记录 要寻找的记录号未知 “查找”“查找记录” 2.4 数据录入2.4.4 查找变量一、EpiData简介二、数据库的建立三、数据库的管理与维护四、数据库的输出与输入五、其他需要注意的问题 EpiData数据管理和录入流程 建立调查表文件创建数据库建立核查文件录入数据数据库管理输出数据三、 数据库的管理和维护3.1 数据库的追加与合并3.2 双录入核查3.3 数据库相关信息的管理 3.1 数据库的追加与合并将两个数据库合并建成另一个新的数据库追加(append)是将两个数据结构完全一样或基本上一样的数据库连起来。两个数据库是端对端(end-to-end ),又称串联。合并(merge ) 是将两个结构不同、但是有1-3个相同变量(如,ID 变量或key 变量)的数据库合并。这样的两个数据库合并是边对边(side-to-side),又称并联。3.1 数据库的追加与合并(1)数据库的追加3.1 数据库的追加
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- JJF 2421-2026表面等离子体共振生物分子相互作用分析仪校准规范
- 健康培训课件分享
- 防治领域就业前景与发展路径-标准模板
- 缫丝工诚信水平考核试卷含答案
- 盔帽工安全文化能力考核试卷含答案
- 德国汽车人工智能技术
- 锅炉管阀检修工安全强化知识考核试卷含答案
- 脚轮制作工冲突管理考核试卷含答案
- 应急救援员班组考核水平考核试卷含答案
- 铁合金转炉冶炼工岗前安全管理考核试卷含答案
- 炸鸡店的员工奖惩制度梳理
- 整式的乘除易错题(14考点40题)解析版-2024-2025学年北师大版七年级数学下册
- 出入库登记表模板
- 人教版五年级下册语文期末考试题
- 护士沟通技巧与人文关怀护理课件
- 一例脊髓损伤患者的护理查房
- DL/T 5155-2016 220kV~1000kV变电站站用电设计技术规程
- 《磁法勘探》07 第七章 磁异常的处理与转换
- NB-T 10942-2022 10kV及以下有源型电压暂降治理设备通用技术要求
- GB/T 2005-1994冶金焦炭的焦末含量及筛分组成的测定方法
- GB/T 13773.2-2008纺织品织物及其制品的接缝拉伸性能第2部分:抓样法接缝强力的测定
评论
0/150
提交评论