版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、总体:根据研究目的确定的同质观察单位的全体。是同质所有 (2)多分类:各类间互不相容。24、无序分类变量资料:计数资观察单位的某种变量值的集合。2、有限总体:是指空间、时间范料,又称定性资料。是将观察单位按照某种属性或类别分组计数,围限制的总体。3、无限总体:是指没有空间、时间限制的总体。4、样本:从总体中随机抽取部分观察单位,其实测值的集合。 5、计量资料:又称定量资料或数值变量资料。为观测每个观察单位的某项指标的大小,而获得的资料。其变量值是定量的,表现为数值大小,一般有度量衡单位。根据其观测值取值是否连续,又可分为连续型或离散型两类。6、计数资料:又称定性资料或者无序分类变量资料,亦称名义变量资料,是将观察单位按照某种属性或类别分组计数,分组汇总各组观察单位数后得到的资料。其变量值是定性的,表现为互不相容的性或类别。分两种情形: (1)二分类:两类间相互对立,互不相容。 (2)多分类:各类间互不相容。7、等级资料:又称半定量资料或有序分类变量资料,是将观察单位按某种属性的不同程度分成等级后分组计数,分类汇总各组观察单位数后而得到的资料。其变量值具有半定量性质,表现为等级大小或属性程度。8、随机误差(偶然误差):是一类不恒定的、随机变化的误差,由多种尚无法控制的因素引起,观察值不按方向性和系统性变化,在大量重复测量中,它可呈现或大或小,或正或负的规律性变化。9、平均数:描述一组变量值的集中位置或水平。常用的平均数有算术平均数、几何平均数和中位数。10、抽样误差:由于个体差异和随机抽样造成的样本统计量和总体参数之间的差异,以及统一总体若干样本统计量之间的差异。13、相对数:两个有联系的指标之比,是分类变量常用的描述性统计指标,常用两个分类的绝对数之比表示相对数学的大小。如率、构成比、比等。14、率:强度相对数,说明某现象发生的频率或强度。15、构成比:结构相对数字,表示事物内部某一部分的个体与该事物各个部分个体数的和之比。用来说明各构成部分在总体所占的比重或分布。 16、相对比:简称比,是两个相关联指标之比,说明两指标间的比例关系。两指标可以性质相同,也可以性质不同,通常以倍数或百分数表示。两指标可以是绝对数、相对数或平均数。17、标准化:采用某影响因素的统一标准构成以消除内部构成不同对总率的影响,使通过标化后的标准率具有可比性。18、动态数列:是一系列按时间顺序排列起来的统计指标,用以观察和比较该事物在时间上的变化和发展趋势。常用指标有绝对增长量、发展速度与增长速度、平均发展速度与平均增长速度。19、非参数检验:相对于参数检验而言,不依赖于总体分布类型,也不对总体参数进行统计推断的假设检验方法,称为参数检验。20、相关系数:又称Pearson积差相关系数,以符号r来表示。说明两正态变量间相关关系的密切程度和方向的指标。无单位,其值为-Kr<1。相关系数的检验假设常用t检验。21、回归系数:即线性回归方程的斜率b,其统计意义是当X变化一个单位时Y的平均改变的估计值。在直线回归中对回归系数的t检验与F检验等价。22、随机划原则:是指在实验分组时.每个受试对象均有相同的概率或机会被分陪配到实验组和对照组。 23、分类变量资料:计数资料,又称定性资料或无序分类变量资料。是将观察单位按照某种属性或类别分组计数,分组汇总各组观察单位数后得到的资料。其变量值是定性的,表现为互不相容的性或类别。分两种情形:(1)二分类:两类间相互对立,互不相容。分组汇总各组观察单位数后得到的资料。其变量值是定性的,表现为互不相容的性或类别。分两种情形: (1)二分类:两类间相互对立,互不相容。(2)多分类:各类间互不相容。 25、期望寿命:指同时出生的一代人活满x岁以后尚能生存的年数(即岁数)。26、检验效能:表达式为1-3以往称把握度。其意义为当两总体确有差异,按规定检验水准所能发现该差异的能力。 27、观察单位:亦称个体,是统计研究中的基本单位。它可以是一个人、一只动物,也可以是特指的一群人;可以是一个器官,甚至一个细胞。28、样本含量:样本中包含观察单位数称为该样本的样本含量。29、变量:确定总体之后,研究者应对每个观察单位的某项特征进行观察或测量,这种特征能表现观察单位的变异性,成为变量。30、变量值:对变量的观测值称为变量值或观察值。 31、误差:泛指实测值与真实值之差,按产生原因和性质可粗分为(1)随机误差;(2)非随机误差①系统误差②非系统误差。 32、系统误差:实验过程中产生的误差,它的值或恒不变,或遵循一定的变化规律,其产生的原因往往是可知的或可能掌握的。应尽可能设法预见到各种系统误差的具体来源,力求通过周密的研究设计和严格的技术措施施加以消除或控制。 33、非系统误差:在实验过程中由于研究者偶然失误造成的误差。这类误差应当通过认真检查核对予以清除,否则将影响研究结果的准确性。 34、频率:一个随机试验有几种可能,在结果重复进行试验时,个别结果看来是偶然发生,但当重复试验次数相当大时,总有规律岀现。在重复多次后,岀现结果的比例称之为频率。 35、概率:概率是描述随机事件发生可能性大小的一个度量。 36、医学参考值:是直指包括绝大多数正常人的人体形态、功能和代谢产物等个各种生理指标常数,也称正常值。由于存在个体差异,生物医学数据并非常数而是在一定范围内波动,故医学参考值范围作为判定正常和异常的参考标准。37、正态分布:正态分布又称高斯分布,是一种很重要的连续型分布,应用很广。若指标 X的频率分布曲线对应于数学上的正态分布曲线,则称该指标服从正态分布。 3&38.偏态分布:指集中位置偏向一侧,频数分布不对称。 (1)正偏态分布:集中位置偏向数值小的一侧。 (2)负偏态分布:集中位置偏向数值大的一侧。39.抽样:在医学研究中,为节省人力、物力、财礼和时间,一般都采取从总体中抽取样本,根据样本信息来推断总体特征的方法,即抽样研究的方法来实现,这种从总体种随机抽取部分观察单位的过程称为抽样。 为保证样本的代表性,抽样时必须遵循随机化原则。 40.统计描述:指选用恰当的指标,通常称为统计量,选用合适的统计表与统计图,对资料的数量特征及其分布规律进行测定和描述。包括搜集数据、整理数据、总结数据、分析数据以及将数据呈现出来 .41.统计推断:指如何在一定的可信度下由样本信息统计指标来推断总体相应指标,又称参数估计。包括进行推测、假设检验、确定关系然后作岀预测。42.小概率事件:统计分析中的很多结论都是基于一定可信程度下的概率推断,习惯上将P<=0.05称为小概率事件,表示一次实验或观察中该事件发生的可能很小,可以视为可能不发生。 43.算术均数:简称均数可用于反映一组呈对称分布的变量值在数量上的
mean): 可用于反映一组经对数转换后呈对称分布的变量值在数量上的平均水平。适用条件:呈倍数关系的等比资料或对数正态分布(正偏态)资料;如抗体滴度资料 45.中位数(median):是将变量值从小到大排列,位置居于中间的那个变量值。符号为Md反映一批观察值在位次上的平均水平。适用于:1、各种分布类型的资料2、特别是偏态分布资料和开口资料(一端或两端无确切数值的资料)。3、资料分布不明等46.百分位数:将一组数据从大到小按顺序排列起来,并计算相应的累计百分位(频率) 。那某一百分位所对应的数据变量值就叫这一百分位的百分位数百分位数的应用:确定医学参考值范围 ;中位数Md与四分位半间距QD—起使用,描述偏态分布资料的特征。 47.百分位数:数据从小到大排列;在百分尺度下,所占百分比对应的值。记为Px。包括直接算法和频数表法。应用:1.确定医学参考值范围(referencerange):女口95%参考值范围=P97.5—P2.5;表示有95%正常个体的测量值在此范围。2.中位数Md与四分位半间距QD—起使用,描述偏态分布资料的特征。也称均方差(meansquaredeviation),方和的均值。表示一组数据的平均离散情况。方差(variance)样本观察值的离均差平标准差(standarddeviation)即方差的正平方根;其单位与原变量X的单位相同。方差(variance)样本观察值的离均差平标准差(standard制,则n个数据可取任意值,称为有n个自由度。51.变异系数:多用于观察指标单位不同时,如身高与体重的变异程度的比较;或均数相差较大时,如儿童身高与成人身高变异程度的比较。 52.医学参考值(referencevalue)是指包括绝大多数正常人的人体形态、机能和代谢产物等各种生理及生化指标常数,也称正常值。由于存在个体差异,生物医学数据并非常数而是在一定范围内波动,故采用医学参考值范围( medicalreferencerange)作为判定正常和异常的参考标准。53.95%可信区间:从总体中作随机抽样,作100次抽样,每个样本可算得一个可信区间,得100个可信区间,平均有95个可信区间包括讥估计正确),只有5个可信区间不包括g(估计错误)。54.假设检验过去称显著性检验:它是利用小概率反证法思想,从问题的对立面 (H0)100个要解决的问题(H1)是否成立。然后在H0成立的条件下计算检验统计量,最后获得 P值来判断。55.检验水准:•,过去称显著性水准,是预先规定的概率值,它确定了小概率事件的标准。在实际工作中常取:-=0.05。可根据不同研究目的给予不同设置。 56.P的含义是指从H0规定的总体随机抽样,抽得等于及大于(或/和等于及小于)现有样本获得的检验统计量(如t、u等)值的概率。57.I型错误:“实际无差别,但下了有差别的结论”,假阳性错误。犯这种错误的概率是(其值等于检验水准)°58.II型错误:“实际有差别,但下了不拒绝H0的结论”,假阴性错误。犯这种错误的概率是(其值未知)。59.完全随机设计:是采用完全随机化的分组方法,将全部试验对象分配到 g个处理组(水平组),各组分别接受不同的处理,试验结束后比较各组均数之间的差别有无统计学意义,推论处理因素的效应。 60.组间变异:各处理组由于接受处理的水平不同,各组的样本均数 (i=1,2,…,g)也大小不等,这种变异称为组间变异。其大小可用各组均数与总均数组中,虽然每个受试对象接受的处理相同, 但测量值仍各不相同,这种变异称为组内变异(误差)。组内变异可用组内各测量值 Xij与其所在组的均数的差值的平方和表示, 记为SS组内,表示随机误差的影响。62.随机区组设计(randomizedblockdesign)又称为配伍组设计,是配对设计的扩展。具体做法是:先按影响试验结果的非处理因素(如性别、体重、年龄、职业、病情、病程等)将受试对象配成区组(block),再分别将各区组内的受试对象随机分配到各处理或对照组。63.绝对增长量;是说明事物在一定时期增长的绝对值。64.发展速度与增长速度:均为相对比,说明事物在一定时期的速度变化。发展速度表示报告期指标的水平相当于基期水平的百分之多少或若干倍。 65.平均发展速度;是各环比发展速度的几何平均数,说明某事物在一个较长时期中逐期(如逐年)平均发展的程度。66.平均增长速度;是各环比增长速度的平均数,说明某事物在一个较长时期中逐期平均增长的程度。 67.b的意义:回归系数b称为斜率(slope),其统计学意义是:X每增加(减)一个单位,丫平均改变b个单位。68.残差(residual)或剩余值,即实测值Y与假定回归线上的估计值 Y的纵向距离。69.直线相关系数(correlationcoefficient),Pearson积差相关系数,用来说明具有直线关系的两变量间相关的密切程度与相关方向。70.统计图:指利用点的位置、线段的升降、直条的长短和面积的大小等各种几何图形来表达统计资料。统计图只能提供概略的情况,而不能获得确切数值,因此不能完全代替统计表,常需要同时列岀统计表作为统计图的数值依据。 71.百分条图:是以矩形总长度作为100%,将其分割成不同长度的段表示各构成的比例。圆图和百分条图适合描述分类变量的各类别所占的构成比。百分条图以总长度L为100%,将长度L乘以各类别的构成比(%)得到各构成的长度,由大到小或按类别的自然顺序依次排列,其它项放最后。72.箱式图(boxplot):使用5个统计量反映原始数据的变异范围和异常分布特征,即数据分布中心位置、分布、偏度、值。箱式图的箱子两端分别是上、下四分位数,两端连线分别是除异常值之外的最小与最大值。中间是中位数,箱子越长数据变异程度越大,中间横线在箱子中点表明分布对称,否则不对称。分布特征,即数据分布中心位置、分布、偏度、值。箱式图的箱子两端分别是上、下四分位数,两端连线分别是除异常值之外的最小与最大值。中间是中位数,箱子越长数据变箱式图特别适合多组数据分布的比较。 73.二项分布(binomialdistribution)是指在只会产生两种可能结果如邙日性”或“阴性”之一的n次独立重复试验中,当每次试验的“阳性”概率 n保持不变时,出现邙日性”次数x=0,1,2,…,n的一种概率分布。记作:X〜B(n,n)。概率可以由下边公式求出:n!XP(X) X(1m)X!(n_X)!X=0n-X,1,2,3、、、n-X,1,2,3、、、,nPoisson分布是描述单位面积、体积、时间、人群等内稀有事件(或罕见事件)发生数的分布。所谓随机变量 X服从Poisson分布,是指在足够多的n次独立Bernoulli试验中,取值X的概率为--Xe%P(X):X=0,1,2,X!X=0,1,2,非参数检验针对某些资料的总体分布难以用某种函数式来表达,或者资料的总体分布的函数式是未知的,只知道总体分布式连续型的或是离散型的,用于解决这类问题需要一种不依赖总体分布的具体形式的统计分析方法。由于这类方法不受总体参数的限制,故称为非参数统计,或称为不拘分布的统计分析方法,又称为无分布型式假定的统计分析方法。适于处理总体分布不易确定或未知;分布非正态但无合适转换方法;有一端或两端有不确定数值(如<0.1,>15.0)的资料;等级资料等。参数检验:通常要求样本来自总体分布类型已知(正态分布)在这种假设的基础上,对总体参数(如总体均数)进行估计和检验,称为参数检验。例如,均数的区间估计; t检验/u检验,F检验。77.“球对称”假设:满足“球对称”假设,可用第四章随机区组方差分析比较处理组间差异;若不满足“球对称”假设,亦可用随机区组方差分析,但需校正时间效应 F界值的自由度。78.单变量分析:研究单个变量的数量特征,推断两个或多个总体参数的差别。双变量分析:研究两个变量的数量依存(或依赖)关系或互依(或相关)关系。 多变量分析:研究多个变量的数量依存(或依赖)关系或互依(或相关)关系。 79.单独效应:指其他因素的水平固定时,同一因素不同水平间的差别。 80.主效应:指某一因素各水平间的平均差别 81.交互作用:当某因素的各个单独效应随另一因素变化而变化时,则称这两个因素间存在交互作用。82.正交试验:非全面组合,g个处理组是各因素各水平的部分组合,即析因设计 的部分实施。优点:减少试验次数缺点:牺牲分析各因素部分交互作用 83.b0为截距:表示各自变量均为0时y的的估计值。bi称为偏回归系数,是Bi的估计值,表示当方程中其他自变量保持不变时,自变量 Xi变化一个计量单位,反应变量Y的平均变化量。b称为X=(X1,X2,…,xm时,反应变量Y的估计值。e是去除m个自变量对Y影响后的随机误差(残差)。84.偏相关系数:扣除其他变量的影响后,变量 Y与Xi的相关,称为Y与Xi的偏相关系数。 85.优势比OR(oddsratio)流行病学衡量危险因素作用大小的比数比例指标。 86.优势比估计:可反映某一因素两个不同水平( c1,c0)的优势比。87.logistic回归:是一个概率型模型,因此可以利用它预测某事件发生的概率。例如在临床上可以根据患者的一些检查指标,判断患某种疾病的概率有多大。88.综合评价:利用多项指标对某个评价对象的某种属性进行定性、定量评估,或者对多个评价对象的属性进行定性、定量评估,可对优劣顺序排序。89.秩和比(RankSumRatio,RSR)指行(或列)秩次的平均值,是一个非参数统计量,具有0~1连续变量的特征。在综合评价中,秩和比综合了多项评价指标的信息,表明多个评价指标的综合水平, RSRt越大越优。90.完全数据:一部分研究对象可观察到死亡,从而得到准确的生存时间,所提供的信息是完全的91.不完全数据:亦称截尾数据:一部分病人,或中途失访,或到观察结束时仍存活,对这部分病人无法知道准确的生存时间,只知道其生存时间比观察到的时间要长,它提供不完全的信息,称为不完全数据,亦称截尾数。 92.生存时间:生存时间(survivaltime)是任何两个有联系事件之间的时间间隔,常用符号t表示。狭义的生存时间常指患某种疾病的病人从发病到死亡所经历的时间跨度,广义的生存时间定义为从某种起始事件到终点事件所经历的时间跨度。 93.生存函数:生存函数(survivalfunction)又称为累积生存率,简称生存率。表示具有协变量X的观察对象其生存时间T大于时间t的概率,常用S(t,X)=P(T〉t,X)表示。94.死亡概率:表示一个观察对象从开始观察到时间t为止的死亡概率,它是一个随时间上升的函数:F(t,X)=P(T<t,X),当t趋于无穷大时,死亡概率等于 1。1、统计资料可以分成几类?答:根据变量值的性质,可将统计资料分为数值变量资料(计量资料),无序分类变量资料(计数资料),有序分类变量资料(等级资料或半定量资料)。用定量方法测定某项指标量的大小,所得资料,即为计量资料;将观察对象按属性或类别分组,然后清点各组人数所得的资料,即为计数资料;按观察对象某种属性或特征不同程度分组,清点各组人数所得资料称为等级资料。2、不同类型统计资料之间的关系如何 ?答:根据分析需要,各类统计资料可以互相转化。如男孩的岀生体重,属于计量资料,如按体重正常与否分两类,则资料转化为计数资料;如按体重分为:低体重,正常体重,超体重,则资料转化为等级资料。计数资料或等级资料也可经数量化后,转化为计量资料。如性别,结果为男或女,属于计数资料,如男性用 0(或1),女性用1(或0)表示,则将计数资料转化为计量资料。3、频数分布有哪两个重要特征?答:频数分布有两个重要特征:集中趋势和离散趋势,是频数分布两个重要方面。将集中趋势和离散趋势结合起来分析,才能全面地反映事物的特征。一组同质观察值,其数值有大有小,但大多数观察值集中在某个数值范围,此种倾向称为集中趋势。另一方面有些观察值较大或较小,偏离观察值集中的位置较远,此种倾向称为离散趋势。 4、标准差有什么用途?答:标准差是描述变量值离散程度常用的指标,主要用途如下:①描述变量值的离散程度。两组同类资料(总体或样本)均数相近,标准差大,说明变量值的变异度较大,即各变量值较分散,因而均数代表性较差;反之,标准差较小,说明变量异度较小,各变量值较集中在均数周围,因而均数的代表性较好。②结合均数描述正态分布特征;③结合均数计算变异系数CV;④结合样本含量计算标准误。5、变异系数(CV)常用于哪几方面?答:变异系数是变异指标之一,它常用于以下两个方面 :①比较均数相差悬殊的几组资料的变异度。如比较儿童的体重与成年人体重的变异度,应使用CV;②比较度量衡单位不同的几组资料的变异度。 如比较同性别,同年龄人群的身高和体重的变异度时,宜用 CV。6、制定参考值范围有几种方法?各自适用条件是什么?答:制定参考值范围常用方法有两种 :①正态分布法:此法是根据正态分布的原理,依据公式:X±uS计算,仅适用于正态分布资料或对数正态分布资料。95%双侧参考值范围按:X±1.96S计算;95%单侧参考值范围是:以过低为异常者,则计算:X-1.645S,过高为异常者,计算X+1.645S。若为对数正态分布资料,先求出对数值的均数及标准差,求得正常值范围的界值后,反对数即可。②百分位数法。用P2.5〜P97.5估计95%双侧参考值范围;P5或P95为95%单侧正常值范围。百分位数法适用于各种分布的资料 (包括分布未知),计算较简便,快速。使用条件是样本含量较大,分布趋于稳定。一般应用于偏态分布资料、分布不明资料或开口资料。 7、计量资料中常用的集中趋势指标及适用条件各是什么 ?答:常用的
描述集中趋势的指标有:算术均数、几何均数及中位数。①算术均数,简称均数,反映一组观察值在数量上的平均水平,适用于对称分布,尤其是正态分布资料;②几何均数 :用G表示,也称倍数均数,反映变量值平均增减的倍数, 适用于等比资料,对数正态分布资料;③中位数:用M表示,中位数是一组观察值按大小顺序排列后,位置居中的那个观察值。它可用于任何分布类型的资料,但主要应用于偏态分布资料,分布不明资料或开口资料。8、标准差,标准误有何区别和联系?答:标准差和标准误都是变异指标,但它们之间有区别,也有联系。区别 :①概念不同;标准差是描述观察值(个体值)之间的变异程度;标准误是描述样本均数的抽样误差;②用途不同;标准差常用于表示变量值对均数波动的大小,与均数结合估计参考值范围,计算变异系数,计算标准误等。标准误常用于表示样本统计量(样本均数,样本率)对总体参数(总体均数,总体率)的波动情况,用于估计参数的可信区间,进行假设检验等。③它们与样本含量的关系不同 :当样本含量r足够大时,标准差趋向稳定;而标准误随 n的增大而减小,甚至趋于0。联系:标准差,标准误均为变异指标,如果把样本均数看作一个变量值,则样本均数的标准误可称为样本均数的标准差;当样本含量不变时,标准误与标准差成正比;两者均可与均数结合运用,但描述的内容各不相同。9、统计推断包括哪几方面内容,答:统计推断包括:参数估计及假设检验两方面。参数估计是指由样本统计量(样本均数,率)来估计总体参数(总体均数及总体率),估计方法包括点值估计及区间估计。点值估计直接用样本统计量来代表总体参数,忽略了抽样误差;区间估计是按一定的可信度来估计总体参数所在的范围,按 X±ubx或X±uSX来估计。假设检验是根据样本所提供的信息,推断总体参数是否相等。 10、假设检验的目的和意义是什么?答:在实际研究中,一般都是抽样研究,则所得的样本统计量(均数、率)往往不相等,这种差异有两种原因造成:其一是抽样误差所致,其二是由于样本来自不同总体。如果是由于抽样误差原因引起的差别,则这种差异没有统计学意义,认为两个或两个以上的样本来自同一总体,;另一方面如果样本是来自不同的总体而引起的差异,则这种差异有统计学意义,说明两个或两个以上样本所代表的总体的参数不相等。样本统计量之间的差异是由什么原因引起,可以通过假设检验来确定。因此假设检验的目的是推断两个或多个样本所代表的总体的参数是否相等。11、何谓假设检验?其一般步骤是什么?答:所谓假设检验,就是根据研究目的,对样本所属总体特征提岀一个假设,然后用适当方法根据样本所提供的信息,对所提岀的假设作岀拒绝或不拒绝的结论的过程。假设检验一般分为五个步骤①建立假设:包括:H0,称无效假设;称备择假设;②确定检验水准:检验水准用a表示,a一般取0.05:③计算检验统计量:根据不同的检验方法,使用特定的公式计算;④确定P值:通过统计量及相应的界值表来确定 P值;⑤推断结论:如P>a,则接受H。,差别无统计学意义;如P<a,则拒绝H。,差别有统计学意义。12、假设检验有何特点?答:假设检验的特点是:①统计检验的假设是关于总体特征的假设;②用于检验的方法是以检验统计量的抽样分布为理论依据的;③作岀的结论是概率性的,不是绝对的肯定或否定。13、如何正确理解差异有无显著性的统计学意义?答:在假设检验中,如P<a,则结论是:拒绝Ho,接受Hi,习惯上又称“显著”,此时不应该误解为相差很大,或在医学上有显著的(计学意义?答:在假设检验中,如P<a,则结论是:拒绝Ho,接受Hi,习惯上又称“显著”,此时不应该误解为相差很大,或在医学上有显著的(重要的)价值;相反,如果P>a,结论是不拒绝Ho。习惯上称“不显著”,不应理解为相差不大或一定相等。有统计学意义(差异有显著f性)不一定有实际意义;如某药平均降低血压5mmHg,经检验有统计学意义, 但在实际中并无多大临床意义,不能认为该药有效。相反,无统计学意义,并不一定无实际意义。如用新疗法治疗某病,有效率与旧疗法无差异,此时无统计学意义,如果新疗法方法简便,省钱,更容易为病人接受,则新疗法还是有实际意义。14、参考值范围与可信区间区别是什么?答:(1)意义不同:参考值范围是指同质总体中包括一定数量 (如95%或99%)个体值的估计范围,如95%参考值范围,意味该数:值范围只包括95%的个体值,有5%的个体值不在此范围内。可信区间是指按一定的可信度来估计总体参数所在范围。如 95%的可n信区间,意味着做100次抽样,算得100个可信区间,平均有95个可信区间包括总体参数(估计正确)有5个可信区间不包括总体均数(估计错误)。⑵计算方法不同:参考值范围用X±Ua/2S计算。可信区间用X±ta/2Sx或X±Ua/2Sx计算;前者用标准差,后者用标准误。(3)用途不同:参考值范围用于描述绝大多数观察对象某?项指标的分布范围。可信区间用于总体均数的估计,也可间接进资料的u检验和X2检验的应用条件有何异同?答:(1)相同点:四格表资料的u检验是根据正态近似原理进行的,凡能用u检验对两样本率进行检验的资料,均能使用 X2检验,两者是等价的,即u2=X2;u检验和X2检验都存在连续校正的问题。(2)不同点:由于u分布可确定单、双侧检验界值,可使用u检验进行单侧检验;满足四格表u检验的资料,可计算两率之差的 95%可信区间,以分析两率之差有无实际意义;X2检验可用于2X2列联表资料有无关联的检验。17、参数检验与非参数检验有何区别?各有何优缺点?答:参数检验是检验总体参数是否有差别,而非参数检验是检验总体分布的位置是否相同。参数检验的优点是能充分利用样本资料所提供的信息,因此,检验效率较高。其缺点是有较严格的使用条件,如要求总体的分布呈态分布,各总体方差要相等,有些资料不满足使用条件,就不能用参数检验。非参数检验的优点是适用范围广。它不要求资料分布的形式,另外可用于等级资料或不能确切定量的资料。缺点是不能充分利用样本所提供的信息,因此检验效率较低,产生第二类错误较大。 佃、非参数检验适用于哪些情况?答:非参数检验应用于以下情况:①不满足参数检验的资料,如偏态分布资料;②分布不明的资料;③等级资料或开口资料。19、直线回归与相关有何区别和联系? 答:1、区别:①在资料要求上,回归要求因变量y服从正态分布,自变量x是可以精确测量和严格控制的变量,一般称为I型回归;相关要求两个变量x、y服从双变量正态分布。这种资料若进行回归分析称为H型回归。②在应用上,说明两变量间依存变化的数量关系用回归,说明变量间的相关关系用相关。 2、联系:①对一组数据若同时计算r与b,则它们的正负号是一致的;②r与b的假设检验是等价的,即对同一样本,二者的t值相等。③可用回归解释相关。20、常用的统计图有哪几种?它们的适用条件是什么?答:常用的统计图及适用条件是:①条图,适用于相互独立的资料,以表示其指标大小;②百分条图及园图,适用于构成比资料,反映各组成部分的大小;③普通线图:适用于连续性资料,反映事物在时间上的发展变化的趋势,或某现象随另一现象变迁的情况。④半对数线图,适用于连续性资料,反映事物发展速度(相对比)。⑤直方图:适用于连续性变量资料,反映连续变量的频数分布。⑥散点图:适用于成对数据,反映散点分布的趋势。 1集中趋势、离散趋势的统计描述指标以及区别。 答:一、集中趋势的描述指标:统计学用平均数这一指标来描述一组变量值的集中位置或平均水平。(1)算术均数:简称均数字,可用于反映一组呈对称分布的位置在数量上的平均水平。 (2)几何均数:可用于反映一组经对数转换后呈对称分布的变量在数量上的平均水平,在医学研究中常适用于免疫学的指标。(3)中位数:是将n个变量值从小到大排列,位置居中间的那个数。v分为奇偶两种情况。 (4)百分位数:是一种位置指标,用Px来表示。二、描述数据变异大小的常用指标有极差、四分位数间距、方差、标准差和变异系数。 (1)级差:级差即是一组变量最大的值与最小值之差。 (2)四分位数间距:四分位数间距是把全部变量值分为四部分的分位数,即第1四分位数、第2四分位数、第3四分。四分位数间距,是由第三四分位数,和第1四分位数向减而得。(3)方差:也叫均方差,反映一组数据的平均离散水平。 (4)标准差:是方差的正平方根,其量纲与原变量值相同(5)变异系数:记为CV,多用于观察指标单位不同时,或均数相差较大时的比较。它实质上是一个相对变异指标,无单位。三、两者的区别。A、集中趋势的描述:(1)算数均数:适用于对称分布资料; (2)几何均数:适合于作对数变换后对称分布资料;(3)中位数和百分位数:①适用于任何分布的资料;②中位数和百分位数在样本含量较少时不稳定,越靠两端越不稳定;③中位数在抗极端值的影响方面,比均数具有较好的稳定性,但不如均数精确。因此,当资料适合计算均数或几何均数时,不宜用中位数表示其平均水平。不同质的资料应考虑分别计算平均数。B、离散趋势的描述:(1)极差不稳定,不灵敏。(2)标准差的基本内容是离均差,它显示一组变量值与其均数的间距,故标准差直接地、平均地描述了变量值的离散程度。在同质的前提下,标准差大表示变量值的离散程度大,即变量值的分布分散、不整齐、波动较大;反之,标准差小表示变量值的离散程度小,即变量值的分布集中、整齐、波动较小。 (3)变异系数派生于标准差,其应用价值在于排除了平均水平的影响,并消除了单位。2、中位数和标准差的作用。答:(1)标准差:是方差的正平方根,其量纲与原变量值相同。标准差是统计分析中最常用的变异指标,适用于近似正态分布的资料,大样本、小样本均可用。四份位数间距适用于偏态分布资料,四分位半间距相当于偏态分布资料的标准差”。(2)中位数:是将n个变量值从小到大排列,位置居中间的那个数。分为奇偶两种情况。中位数适用于任何分布资料,有不确定值的资料。常用于描述偏态分布资料的集中趋势,反映位次居中的观察值的平均水平。在对称分布的资料中,中位数和算术平均数在理论上是相同的。适用于当一组变量值呈偏态分布,或资料的分布情况不清楚,或变量值一端(或两端)无确定数值(开口型资料),均可用中位数表示其集中趋势。3、正态分布、标准正态分布及对数正态分布的联系和区别。 答:(1)正态分布:原始值不需转换;属于对称分布类型;用卩表示集中趋势的指标;均数与中位数的关系是 尸M(中位数)。(2)标准正态分布:作u转换;属于对称分布类型;集中趋势 尸0;均数与中位数的关系是尸M。(3)对数正态分布:作对数转换;属于正偏太分布;集中趋势用G(几何均数表示);均数与中位数的关系是g>M。1举例说明标准差与标准误的区别与联系。答:标准差是描述个体值变异程度的指标,为方差算术平方根,该变变异不能通过统计方法来控制。而标准误则是指样本统计量的标准差,均数的标准误实质是样本均数的标准差,它反映了样本均数的离散程度,反映了样本均数与总体均数的差异,说明了均数的抽样误差。具体举例略。 2、u分布和t分布有何不同。答:t分布为抽样分布;u分布为标准正态分布,为理论分布。 t分布比标准正态分布的峰值低,且尾部翘得更高。随自由度的增大,t分布逐渐趋近标准正态分布。3、均数的可心信区间与参考值范围有何不同。答:(1)均数的可信区间按预先给定的概率所确定的未知参数的可能范围。用于估计总体的均数。 (2)参考值范围是“正常人”的解剖、生理、生化某项指标的波动范围。用于判断观察对象的某项指标正常于否。 4、t检验的应用条件。答:(1)单样本的t检验要求资料服从正态分布。(2)配对t检验要求差值服从正态分布。(3)两样本的t检验要求两组数据服均从正态分布,切两样本的方差相等,尤其对小样本。 5、假设检验的结论不能绝对化。答:通过假设检验作岀的检验推断具有概率性,有可能发生两类错误。拒绝 Ho时犯I型错误,接受Ho时间犯II型错误。6、假设检验和区间估计的区另U。答:假设检验用于推断质的不同的两个总体或多个总体参数是否不等。可信区间估计是用于说明量的大小,推断总体参数的范围。可信区间可以回答假设检验的问题。在判断两个或多个总体参数是否不相等时,假设检验与区间估计是完全等价的。 1方差分析的基本思想和应用条件。答:基本思想:是根据实验设计的类型,将全部测量值总的离均差平方和及自由度分解为两个或多个部分,除随机误差作用外。每个部分的变异可由某个因素的作用(或某几个因素的交互作用)加以解释。通过比较不同变异的来源的均方,借助 F分布作岀统计推断从而推论各种研究因素对实验结果的影响。应用条件:①各样本是相互独立的随机样本,均服从正态分布。②相互比较的各样本的总体方差相等。具有方差齐性。 2、随机区组设计与完全随机设计在设计和变异分解上有何不同。 答:随机区组设计:随机分配的次数越多,每次随机分配都对同一区组内的受试对象进行,且歌处理组受试对象数量相同,区组内均衡。四种变异处理组间变异、区组间变异、误差变异、总变异。完全随机设计:采用完全随机化分组方法,将全部试验对象分配到 g个处理组(水平组),各组接受不同的处理。三种变异组间变异、组内变异、总变异。1举例说明为什么不能以构成比代替率。答:(1)率=某时期内发生某现象的观察单位数字/同时期可能发生某现象的观察单位总数。用来说明某现象发生的频率或强度。(2)构成比=某一组成部分的观察单位数/同一事物各组成部分的观察单位总数。用来说明各构成部分在总体中所占的比重或分布。举例略。2、应用标准化率进行比较时的注意问题。 答:(1只适用于两组内部构成不同,并有可能影响两组分组的情况。 (2)比较几个标准化率时采用统一标准口。 (3)标准化后的标准化率,已不再反映当时当地的实际水平,它只表示相互比较的资料的相对水平。(4)两样本标准化率是样本值,存在抽样误差。 3、相对数的动态指标及作用。答:即动态数列的分析指标:绝对增长量、发展速度与增长速度、平均发展速度与平均增长速度。 (1)绝对增长量:某相对数在一定时期的增长的绝对值; (2)发展速度与增长速度:某相对数在一定时期的速度变化; (3)平均发展速度:各环节比发展速度的几何均数。说明某相对数在一个较长时期中平均发展变化的程度。1、二项分布的应用。答:(1)每次试验之发生两种互斥可能结果,互斥结果的概率和等于 1;(2)每次产生某种结果的概率固定不变;(3)重复试验是独立的。2、Poisson分布的性质。答:(1)总体均数入与总体方差b2相等;(2)当n很大时候,而n很小时候,n=X为常数,Poisson分布是二项分布的极限分布;(3)当入增大,Poisson分布渐近正态分布。当入》20时,做正态分布资料处理。(4)具可加性质。3、二项分布、Poisson分布和正态分布的联系。 答:(1)当n很大时,而n很小的时,且n=X为常数,Poisson分布是二项分布的极限分布;(2)当n较大,而n不接近0也不接近1时候,二项分布近似正态分布。(3)当X增大时,Poisson分布渐进正态分布,一般 X>20时,做正态分布资料处理。 1、X2检验的用途。答:(1)用于推断个总体率或构成比之间有无差别; (2)推断多个总体或构成比之间有无差别;(3)多个样本率比较的X2分割;(4)两个分类变量间有无关联性;(5)频数分布的拟合优度检验。 2、两样本率u检验和X2检验有何区别。答:两样本率进行比较时,若对同一样本资料同时进行u检验和X2检验,在不教正的情况下,X2=u2;u检验通常用于大样本, X2检验用于小样本。3、R*C列联表资料的X2检验应注意的事项。答:(1)R*C列联表中的理论频数不能小于1,或1vTv5的格子数不宜超过格子总数的 1/5;(2)多个样本率比较,若所的到的统计推断为拒绝 H。,接受H1时,只能认为各总体率之间总的来说有差别,但不能说任两个总体率有差别,需进一步做多个样本率的比较,做多个样本率的多重比较。(3)对有序的R*C列联表资料不宜用X2检验。4、R*C列联表资料的分类及其检验方法的选择。 答:(1)分类:双向无序、单向无序、双向有序属性相同、双向有序属性不同。 (2)检验方法的选择:①双向无序R*C列联表资料。研究多个样本率或构成比的比较,用行*列表的X2检验;研究两分类变量间有无关联性以及关系密切程度,可用行*列表的X2检验以及Pearson列联表系数进行分析。②单向无序R*C列联表资料。若R*C表中的分组变量是有序的,而指标变量是无序的,用行 *列表的X°检验分析其构成情况。若R*C表的分组变量是无序的,指标变量是有序的,用秩转换的非参数检验分析。 ③双向有序属性相同R*C列联表资料。用一致性检验分析两种检测两方法的一致性。④双向有序属性不同R*C列联表资料。若研究目的为分析两有序分类变量间是否存在相关关系,用宜等级相关分析或 Pearson积矩相关分析;若研究目的为分析两有序分类变量间是否存在线性变化趋势,宜用有序分组资料的线性趋势检验;若研究目的为分析不同年龄组患者疗效间有无差别时,可视其为单向有序 R*C列联表资料,选用秩转换的非参数检验分析。1、非参数检验,与参数检验的区别。答:非参数检验对总体分布不作严格的假定,不受总体分布的限制,又称任意分布检验。它直接对总体分布(或分布位置)作假设检验。总体分布为已知的数学形式,对其总体参数作假设检验则为参数检验。2、秩转换的非参数检验,适用情况。 答:秩转换的非参数检验是先将数值变量从小到大,或等级从弱到强转换成秩后,再计算检验统计量。其特点是假设检验的结果对总体的分布形状差别不敏感,只对总体的分布位置差别敏感。适用于:①不满足正态或(和)方差齐性的小样本资料;②分布不知是否正态的小样本资料;③一端或两端是不确切数值的资料;④等级资料。3、两组或多组等级资料的比较,为何不用 X2检验而用秩转换的非参数检验。答:X2检验只能推断两个或多个总体的等级构成比的差别。选用秩转换的非参数检验,可推断两个或多个总体的等级强度差别。1、何为“最小二乘”原则。答:在直线回归方程中,将实际测量值与假定回归线上估计值的纵向距离称之为残差,通常情况下取各点残差的平方和的最小直线为所求得的回归直线。即所谓的“最小二乘原则”。2直线回归分析中的注意问题(即直线回归的应用条件)。答:(1)两变量的选择一定要有专业背景,直线回归要求至少对于每个X相应的Y要服从正态分布,X可以是服从正态分布的随机变量也可以能精确测量和严格控制的非随机变量。(2)分析前应绘制散点图,检查数据是否满基本假设。(3)对结果应有正确的解释。3、直线回一归与直线相关的区别与联系。答:联系:(1)对于既可以做回归分析又可做相关的同一组数据,计算岀的 b与r的正负号一致;(2)相关系数与回归系数的假设检验等价。对同一样本 tb=tr。(3)同一组数据的相关系数和回归系数可以相互换算。 (4)用回归解释相关:由于决定系数r2=ss回/SS总,当总平方和固定时,回归平方和的大小决定了相关的密切程度,回归平方和越接近总平方和,则 r2越接近1,说明相关的效果越好。区别:(1)资料上:相关要求X、Y服从双变量正态分布,这种资料进行回归称 II型回归;回归要求Y在给定某个X值服从正态分布,X是可以精确测量和严格控制的变量,称|型回归。(2)应用上:双变量间相互关系用用相关,此时两变量的关系是平等的;而说明两变量间依存变化的数量关系用回归,用以说明Y如何依赖于X而变化。(3)意义上:说明具有直线关系的两变量间相互关系的方向与密切程度; b表示X每变化一个单位所导致的Y的平均变化量(4)单位:r没单位,b有单位。(5)取值范围不同(6)计算公式不同。1、统计表的制表原则与要求。答:原则:(1)重点突岀,一张表只表达一个中心内容;(2)统计表描述要完整,有起描述的对象(主语)和内容(宾语),通常主语放在表的左边作横标目,宾语放在右边作纵标目。(3)统计表应简单明了,文字数字、线条尽量从简。要求:(1)标题:概括表的主要内容,包括研究时间、地点、内容等放在在表的正上方。(2)标目:分别用横标目和纵标目说明表的每行和每列数字的意义。注单位。 (3)线条:至少要用三线条,表格的顶线和底线将表格与文章的其它部分隔开来,纵标目下横线将标目的文字区与表格的数字区分隔开来。 (4)数字:
五、分析应用题1.Cox模型与logistic回归模型有何不同?Cox模型与logistic回归分析具有相似之处,即在估计岀回归系数后可以得到协变量对应的相对危险度。但logistic 回归模型是一种概率模型,不同,而甲乙两医院所治疗的病人,其病型构成不一样,因此两家医院总的治愈率没有可比性,应对其进行标准化后再比较。只考方江剪刀草合剂,可以应用什么统计分析方法?根据下表资料,欲分析胆麻片对慢性气管炎的疗效是否优于复只考方江剪刀草合剂,可以应用什么统计分析方法?虑了事件是否发生,而不考虑事件发生所需要的时间长短。 Cox模型不仅考虑了事件发生的结果,同时也利用了生存时间提供的信息,因此其效率较高。2」ogistic 回归与线性回归有什么不同?两种方法各有什么特点? logistic 回归属于概率型非线性回归,应变量Y是一个二值变量(服从二项分布),而线性回归的应变量一般为连续变量(正态分布)。线性回归对资料的分析比较细腻,级适合大样本资料又适合小样本数据,但要求对不同的自变量取值。应变量Y服从正态分布和等方差,这一条件有时在实际中不能得到满足。Logistic回归则对资料几乎没有什么限制,而且参数具有明确的实际意义(得到 OR的估计值),但要求有较大的样本含量。—某医师用甲乙两疗法治疗小儿单纯消化不良,结果如下表:欲比较两种疗法的治愈率是否相同,应使用何种统计方法?疗法治疗人数治愈人数治愈率(%)甲13646.2乙18844.4合计311445.2答:这是一个四格表资料,作两样本率的比较,由于n较小(n=31),应采用四格表确切概率法(直接计算概率法)进行检验复方江剪刀草合剂与胆麻片对慢性气管炎的疗效药物疗效无效好转显效控制复方江剪刀草合剂760187062030胆麻片9512111答:这是一个单向有序列联表(等级)资料,可以采用秩和检验进行比较。某部队共有1200人,在某段时间内患某病人数有 120人,其中男性114人(95%),女性6人(5%)。某卫生员进行统计分析后说:该病的两性发病率之间相差非常显著,由此得岀结论“该病男性易得”。你对这个结论有何看法?为什么?答: 这个结论值得怀疑。因为1200人中男性和女性的人数并不知道,因此该资料仅能计算构成比,而不能计算男女性的发病率,。若1200人中,只有6名女性,则结论正好与卫生员得岀的结论相反。 6.某医院用中药治疗7例再生障碍性贫血患者,现将血红蛋白( g/L)变化的数据列在下面,假定资料满足各种参数检验所要求的前提条件,若要了解治疗前后之间的差别有无显著性意义,应当选择哪种检验方法,2.为观察骨质增生丸对大骨节病的疗效,于治疗前测量踝关节的伸屈幅度,治疗80天后复测,两次测量所得的成对数据的差值可解治疗前后之间的差别有无显著性意义,应当选择哪种检验方法,表示治疗的作用,结果如下。欲比较大骨节病人
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2026年左权县带编教师招聘考试备考试题及答案解析
- 2026年镇雄县医疗事业单位人员招聘考试参考题库及答案解析
- 2026年蔚县带编教师招聘笔试参考题库及答案解析
- 2026年宁洱哈尼族彝族自治县医疗事业单位人员招聘考试模拟试题及答案解析
- 2026年息县医疗事业单位人员招聘笔试备考试题及答案解析
- 2026年高邑县医疗事业单位人员招聘笔试备考试题及答案解析
- 2026年黎川县医疗事业单位人员招聘考试备考题库及答案解析
- 2026年富顺县医疗事业单位人员招聘考试备考题库及答案解析
- 2026年福贡县带编教师招聘笔试备考题库及答案解析
- 2026年靖远县中小学幼儿园教师招聘考试备考试题及答案解析
- 2026年达拉特旗社区工作者招聘考试试卷-含答案解析
- 2026年江苏省科学大众金钥匙科技竞赛试题及答案
- 2026年中级银行从业资格之中级个人贷款题库含答案
- 新教材人教版二年级上册数学教学计划及进度安排
- DB50T 2010-2026 医养结合机构服务质量规范
- (完整版)石材台阶专项施工方案
- 苏州工业园区金鸡湖街道2026年社工招聘考试【结构化面试题库+高分答题模板】(含考官评分要点)
- 2026新教材人教版九年级上册英语 Unit 1 The Changing World 单元综合测试卷(含答案)
- 药物临床治疗学试题及答案2026版
- 会计师事务所业务管理制度-模板
- 畜禽舍气流控制
评论
0/150
提交评论