第7章假设检验_第1页
第7章假设检验_第2页
第7章假设检验_第3页
第7章假设检验_第4页
第7章假设检验_第5页
已阅读5页,还剩151页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、假设检验假设检验参数假设检验参数假设检验非参数假设检验非参数假设检验这类问题称作假设检验问题这类问题称作假设检验问题 .总体分布已总体分布已知,检验关知,检验关于未知参数于未知参数的某个假设的某个假设总体分布未知时的假设检验问题总体分布未知时的假设检验问题我们将讨论不同于参数估计的另一类重要的统计推我们将讨论不同于参数估计的另一类重要的统计推断问题断问题. 这就是这就是根据样本的信息检验关于总体的某个根据样本的信息检验关于总体的某个假设是否正确假设是否正确.第第7章章 假设检验假设检验7.1 7.1 假设检验的基本思想和概念假设检验的基本思想和概念),(2N5 . 25 .482nSkgx例1

2、 工厂中自动打包机打包,每包重量每包重应为50kg,由于机器存在误差,打包重量并不是50kg,现从中任取9包,测得 问:打包机工作是否正常?例2 学生的考试成绩是否服从正态分布?例3 某研究所推出一种感冒特效药,为证明其疗效,选择200名患者为志愿者。将他们均分为两组,分别不服药或服药,观察 三日后痊愈的情况,得出下列数据:问:新药是否有明显疗效?问:新药是否有明显疗效? 例1例3所要解决的问题可转化下述问题:)(打包机正常工作kgH50:0例例1 1 )(打包机不正常工作kgH50:1例例2 2 服从正态分布总体:0H不服从正态分布总体:1H例例3 3 新药有效:0H新药无效:1H 生产流水

3、线上罐装可乐不生产流水线上罐装可乐不断地封装,然后装箱外运断地封装,然后装箱外运. 怎怎么知道这批罐装可乐的容量是么知道这批罐装可乐的容量是否合格呢?否合格呢?把每一罐都打开倒入量杯把每一罐都打开倒入量杯, 看看看容量是否合于标准看容量是否合于标准. 这样做显然这样做显然不行!不行!罐装可乐的容量按标准应在罐装可乐的容量按标准应在350毫升和毫升和360毫升之间毫升之间.一、基本概念和思想一、基本概念和思想 每隔一定时间,抽查若干罐每隔一定时间,抽查若干罐 . 如每隔如每隔1小时,抽小时,抽查查5罐,得罐,得5个容量的值个容量的值 ,根据这些值,根据这些值来判断生产是否正常来判断生产是否正常.

4、 如发现不正常,就应停产,找出原因,排除如发现不正常,就应停产,找出原因,排除故障,然后再生产;如没有问题,就继续按规定故障,然后再生产;如没有问题,就继续按规定时间再抽样,以此监督生产,保证质量时间再抽样,以此监督生产,保证质量.通常的办法是进行抽样检查通常的办法是进行抽样检查.521, 在正常生产条件下,由于种种随机因素的影响,在正常生产条件下,由于种种随机因素的影响,每罐可乐的容量应在每罐可乐的容量应在355毫升上下波动毫升上下波动. 这些因素这些因素中没有哪一个占有特殊重要的地位中没有哪一个占有特殊重要的地位. 因此,根据中因此,根据中心极限定理,假定每罐容量服从正态分布是合理的心极限

5、定理,假定每罐容量服从正态分布是合理的.现在我们就来讨论这个问题现在我们就来讨论这个问题.罐装可乐的容量按标准应在罐装可乐的容量按标准应在350毫升和毫升和360毫升之间毫升之间.它的对立假设是:它的对立假设是:称称H0为原假设为原假设(或零假设);(或零假设);称称H1为备选假设为备选假设(或对立假设)(或对立假设).在实际工作中,在实际工作中,往往把不轻易往往把不轻易否定的命题作否定的命题作为原假设为原假设. 0 H0:( = 355)0 H1:0 这样,我们可以认为这样,我们可以认为 是取自正态是取自正态 总体总体 的样本,的样本,是一个常数是一个常数. 2 当生产比较稳定时,当生产比较

6、稳定时,现在要检验的假设是:现在要检验的假设是:521,),(2N那么,如何判断原假设那么,如何判断原假设H0 是否成立呢?是否成立呢?较大、较小是一个相对的概念,合理的界限在何较大、较小是一个相对的概念,合理的界限在何处?应由什么原则来确定?处?应由什么原则来确定?由于由于 是正态分布的期望值,它的估计量是样本是正态分布的期望值,它的估计量是样本均值均值 ,因此可以根据,因此可以根据 与与 的差距的差距 来判断来判断H0 是否成立是否成立.较小时,可以认为较小时,可以认为H0是成立的;是成立的;当当生产已不正常生产已不正常.当当较大时,应认为较大时,应认为H0不成立,即不成立,即0|0|0|

7、0问题归结为对差异作定量的分析,以确定其性质问题归结为对差异作定量的分析,以确定其性质.差异可能是由抽样的随机性引起的,称为差异可能是由抽样的随机性引起的,称为“抽样误差抽样误差”或或 随机误差随机误差这种误差反映偶然、非本质的因素所引起的随机这种误差反映偶然、非本质的因素所引起的随机波动波动. 然而,这种随机性的波动是有一定限度的,然而,这种随机性的波动是有一定限度的,如果差异超过了这个限度,则我们就不能用抽样如果差异超过了这个限度,则我们就不能用抽样的随机性来解释了的随机性来解释了.必须认为这个差异反映了事物的本质差别,即必须认为这个差异反映了事物的本质差别,即反映了生产已不正常反映了生产

8、已不正常.这种差异称作这种差异称作“系统误差系统误差” 问题是,根据所观察到的差异,如何判断问题是,根据所观察到的差异,如何判断它究竟是由于偶然性在起作用,还是生产确实它究竟是由于偶然性在起作用,还是生产确实不正常?不正常?即差异是即差异是“抽样误差抽样误差”还是还是“系统误差系统误差”所引所引起的?起的?这里需要给出一个量的界限这里需要给出一个量的界限 .问题是:如何给出这个量的界限?问题是:如何给出这个量的界限?这里用到人们在实践中普遍采用的一个原则:这里用到人们在实践中普遍采用的一个原则:小概率事件在一次试验小概率事件在一次试验中基本上不会发生中基本上不会发生 . 现在回到我们前面罐装可

9、乐的例中:现在回到我们前面罐装可乐的例中:在提出原假设在提出原假设H0后,如何作出接受和拒绝后,如何作出接受和拒绝H0的结的结论呢?论呢? 在假设检验中,我们称这个小概率为在假设检验中,我们称这个小概率为显著性水显著性水平平,用,用 表示表示. 常取常取 的选择要根据实际情况而定。的选择要根据实际情况而定。 .05. 0,01. 0, 1 . 0 提出假设提出假设选检验统计量选检验统计量 N(0,1) |2uUPH0: = 355 H1: 355由于由于 已知,已知, 它能衡量差异它能衡量差异大小且分布已知大小且分布已知 .对给定的显著性水平对给定的显著性水平 ,可以在,可以在N(0,1)表中

10、查到表中查到分位点的值分位点的值 ,使,使nU0|02u故我们可以取拒绝域为故我们可以取拒绝域为:也就是说也就是说,“2| uU ”是一个小概率事件是一个小概率事件.W:2|uU 如果由样本值算得该统计量的实测值落入区域如果由样本值算得该统计量的实测值落入区域W,则拒绝,则拒绝H0 ;否则,不能拒绝;否则,不能拒绝H0 .|2uUP 如果如果H0 是对的,那么衡量差异大小的某个统计是对的,那么衡量差异大小的某个统计量落入区域量落入区域 W(拒绝域拒绝域) 是个小概率事件是个小概率事件. 如果该统如果该统计量的实测值落入计量的实测值落入W,也就是说,也就是说, H0 成立下的小概成立下的小概率事

11、件发生了,那么就认为率事件发生了,那么就认为H0不可信而否定它不可信而否定它. 否否则我们就不能否定则我们就不能否定H0 (只好接受它)(只好接受它).这里所依据的逻辑是:这里所依据的逻辑是: 不否定不否定H0并不是肯定并不是肯定H0一定对,而只是一定对,而只是说差异还不够显著,还没有达到足以否定说差异还不够显著,还没有达到足以否定H0的程度的程度 .所以假设检验又叫所以假设检验又叫“显著性检验显著性检验” 如果显著性水平如果显著性水平 取得很小,则拒绝域取得很小,则拒绝域 也会比较小也会比较小.其产生的后果是:其产生的后果是: H0难于被拒绝难于被拒绝.如果在如果在 很小的情况下很小的情况下

12、H0仍被拒绝了,则说明实际情仍被拒绝了,则说明实际情况很可能与之有显著差异况很可能与之有显著差异.基于这个理由,人们常把基于这个理由,人们常把 时拒绝时拒绝H0称为称为是是显著的显著的,而把在,而把在 时拒绝时拒绝H0称为是称为是高度高度显著的显著的.05. 001. 0 在上面的例子的叙述中,我们已经初步介绍在上面的例子的叙述中,我们已经初步介绍了假设检验的基本思想和方法了假设检验的基本思想和方法 . 下面,我们给出假设检验的一般步骤下面,我们给出假设检验的一般步骤 .二、假设检验的一般步骤二、假设检验的一般步骤Step1 : 根据问题提出原假设根据问题提出原假设 和备择假设和备择假设 St

13、ep2 : 选取检验统计量选取检验统计量 且其抽样分且其抽样分布中不含任何未知参数,可以查表或通过计算得其布中不含任何未知参数,可以查表或通过计算得其分位数(临界值)分位数(临界值) Step3 : 对于给定的显著性水平对于给定的显著性水平 找临界值,从而确定找临界值,从而确定 拒绝域,使拒绝域,使 Step4 : 判定。若判定。若onHWxxt,拒绝01),( onHWxxt,接受01),( 0H1H),(1ntT ),(01WPn假设检验会不会犯错误呢?假设检验会不会犯错误呢?由于作出结论的依据是下述由于作出结论的依据是下述小概率原理小概率原理小概率事件在一次试验中基本上不会发生小概率事件

14、在一次试验中基本上不会发生 .不是一定不发生不是一定不发生三、假设检验的两类错误三、假设检验的两类错误 如果如果H0成立,但统计量的实测值落入否定成立,但统计量的实测值落入否定域,从而作出否定域,从而作出否定H0的结论,那就犯了的结论,那就犯了“以真以真为假为假”的错误的错误 . 如果如果H0不成立,但统计量的实测值未落不成立,但统计量的实测值未落入否定域,从而没有作出否定入否定域,从而没有作出否定H0的结论,即的结论,即接受了错误的接受了错误的H0,那就犯了,那就犯了“以假为真以假为真”的的错误错误 .请看下表请看下表 假设检验的两类错误假设检验的两类错误H0为真为真实际情况实际情况决定决定

15、拒绝拒绝H0接受接受H0H0不真不真第一类错误第一类错误正确正确正确正确第二类错误第二类错误P拒绝H0 |H0为真= ,P接受H0 |H0不真= . 犯两类错误的概率犯两类错误的概率:显著性水平显著性水平 为犯第一类错误的概率为犯第一类错误的概率. 两类错误是互相关联的,两类错误是互相关联的, 当样本容量固当样本容量固定时,一类错误概率的减少导致另一类错误概定时,一类错误概率的减少导致另一类错误概率的增加率的增加. 要同时降低两类错误的概率要同时降低两类错误的概率 或者要或者要在在 不变的条件下降低不变的条件下降低 ,需要增加样本容量,需要增加样本容量.两类错误的概率的关系两类错误的概率的关系

16、, 提出提出假设假设 根据统计调查的目的根据统计调查的目的, 提出提出原假设原假设H0 和备选假设和备选假设H1作出作出决策决策抽取抽取样本样本检验检验假设假设 对差异进行定量的分析,对差异进行定量的分析,确定其性质确定其性质(是随机误差是随机误差还是系统误差还是系统误差. 为给出两为给出两者界限,找一检验统计量者界限,找一检验统计量T,在在H0成立下其分布已知成立下其分布已知.)拒绝还是不能拒绝还是不能拒绝拒绝H0显著性显著性水平水平P(T W)= -犯第一犯第一类错误的概率,类错误的概率,W为拒绝域为拒绝域总总 结结检验法 7.2 7.2 参数的假设检验参数的假设检验 一、U使得值查正态分

17、布表,得临界,对于给定的,321uo04Uo计算201oUuH拒绝认为有显著性差异。201oUuH接受认为无显著性差异。例例 1 在上节例1中,设方差为4,取=0.01。 问检验打包机的工作是否正常?7.1 7.1 假设检验的基本思想和概念假设检验的基本思想和概念),(2N5 . 25 .482nSkgx例1 工厂中自动打包机打包,每包重量每包重应为50kg,由于机器存在误差,打包重量并不是50kg,现从中任取9包,测得 问:打包机工作是否正常?例2 学生的考试成绩是否服从正态分布?例3 某研究所推出一种感冒特效药,为证明其疗效,选择200名患者为志愿者。将他们均分为两组,分别不服药或服药,观

18、察 三日后痊愈的情况,得出下列数据:3由=0.01,查正态分布表得58. 2995. 012uu4将样本值代入得:58. 225. 20u不能拒绝0H,即认为打包机工作是正常的。由于) 1, 0(/NnU当0H成立时,nU/00未必服从正态分布,010022:,),(2HHN检验已知 xo1ux注:1)检验步骤与1相同;2)单侧(单尾)检验与双侧(双尾)检验。例例 2假设某次考试数学分数)16, 7 .98( N一中的16名学生其平均成绩为101.85分,试判断该校的数学成绩是否优于全市平均水平?(=0.05),随机抽查市T二、 检验法 .:;:),(1010022HHN未知,检验nxt;o2

19、1t21tx22故的拒绝域为 : ),(21010tTxxWn例例3某工厂生产的一种螺钉,标准要求长度是32.5mm. 实际生产的产品,其长度 假定服从正态分布 未知,现从该厂生产的一批产品中抽取6件, 得尺寸数据如下:),(2 N2 32.56, 29.66, 31.64, 30.00, 31.87, 31.03问这批产品是否合格?分析:这批产品(螺钉长度)的全体组成问题的总体 . 现在要检验 是否为32.5.)(E提出原假设和备择假设 第一步:第一步:第二步:第二步:能衡量差异大小且分布已知能衡量差异大小且分布已知取一检验统计量,在H0成立下求出它的分布.),(22未知已知N5 .32:5

20、 .32:10HH)5(65 .32*tStn第三步:第三步:即“ ”是一个小概率事件 . 小概率事件在一次小概率事件在一次试验中基本上不会试验中基本上不会发生发生 . 对给定的显著性水平 ,查表确定临界值 ,使得否定域 W:01. 00322. 4)5()5(005. 02tt)5(|2ttP)5(|2tt 0322. 4|t故不能拒绝H0 .第四步第四步:将样本值代入算出统计量 t 的实测值,| t |=2.9974.0322没有落入拒绝域2112102221212122222111: ,),(),(2HHNN检验但未知例例 4 在漂白工艺中,要考察湿度对针织品断裂强度的影响,在70与80

21、下分别作了八次实验,测得断裂强度数据如下: 70 20.5 18.8 19.8 20.9 21.5 19.5 21.0 21.2 80 17.7 20.3 20.0 18.8 19.0 21.1 20.1 19.1据经验针织品地断裂强度服从正态分布,问:70下的断裂强度与80下的断裂强度有无显著性差异?2三、 检验法 2021202002:),(1HHN检验已知nxx;2x22o2212202120202:),(2HHN检验未知.1220220122nnSnnii例例5 某砖厂生产的红砖质量比较稳定,抗压强度的方差为64,今从一批新砖中任抽10块作抗压强度试验,得数据如下: 578 572 5

22、70 568 572 570 572 596 584 570问是否可相信这批砖的抗压强度的方差也为64?( )05. 0202120202:),(3HHN检验未知由于22220220nSnS拒绝域为 )1(2120nW四、 检验法 FF 检验法是两正态总体值21,方差是否相等和两方差比较进行检验。如第三节例 4中当检验针织品的断裂强度有无显著差异时,其方差看作是相等的,这往往是凭经验而言。严格来说,这是需要经过检验的。未知的情况下,对其2222012112:;:.HH,21,1212nnFFP,21,12112nnFFP2xo2) 1, 1(2112nnF xf) 1, 1(212nnF 拒绝

23、域.1, 11, 12112122nnFFnnFFW),(),(10211021yyyxxx99. 00T见课本总结表见课本总结表五、小结 7.3 7.3 正态母体参数的置信区间正态母体参数的置信区间对于总体的未知参数 ,利用点估计可求得其近似值,但点估计本身既没有反应这种近似值的精确度,又不知道它的误差范围,因此希望估计出一个范围,并希望知道参数真值落在这个范围内的可信程度。 一、置信区间的定义111),( n-置信下限 212),( n-置信上限 ),(11nxx ),(12nxx -置信区间的观测值可靠度与精度是一对矛盾,一般是在保证可靠度的条件下尽可能提高精度.2. 要求 以很大的可能

24、被包含在区间),(11nxx ),(12nxx 内,就是说,概率 要尽可能大 .),(),(1211nnP 即要求估计尽量可靠.3. 估计的精度要尽可能的高. 如要求区间长度),(),(1112nn 尽可能短,或能体现该要求的其它准则.在求置信区间时,要查表求分位点.二、置信区间的求法 1)(baP1)()(aPbP2)(,21)(aPbP若 为连续型随机变量 , 则有221,xbxa所求置信区间为),(221xx或者32)(,31)(aPbP3231,xbxa取所求置信区间为),(3231xx N(0, 1)选选 的点估计为的点估计为 , ,求参数求参数 的置信度为的置信度为 的置信区间的置

25、信区间. 例例1 设设 是取自是取自 的样本,的样本, ,2已知 ),(2 N 1nU取明确问题明确问题,是求什么是求什么参数的置信区间参数的置信区间?置信水平是多少?置信水平是多少?寻找未知参寻找未知参数的一个良数的一个良好估计好估计.解解 寻找一个待估参数和寻找一个待估参数和统计量的函数统计量的函数 ,要求,要求其分布为已知其分布为已知.有了分布,就可以求出有了分布,就可以求出U取值于任意区间的概率取值于任意区间的概率.n,21,1 对给定的置信水平对给定的置信水平查正态分布表得查正态分布表得12,u对于给定的置信水平, 根据U的分布,确定一个区间, 使得U取值于该区间的概率为置信水平.1

26、2|1Pun 使使为什么为什么这样取?这样取?12121Puunn 从中解得从中解得,1 对给定的置信水平对给定的置信水平查正态分布表得查正态分布表得12,u12|1Pun 使使12121Puunn 于是所求于是所求 的的 置信区间为置信区间为1212,uunn 从例1解题的过程,我们归纳出求置信区间的一般步骤如下:1. 明确问题, 是求什么参数的置信区间? 置信水平 是多少?2. 寻找参数 的一个良好的点估计T( ) 3. 寻找一个待估参数 和估计量 T 的函数 U(T, ),且其分布为已知. n,211 4. 对于给定的置信水平 ,根据U(T, )的分布,确定常数a, b,使得 11P(a

27、 U(T, )b) = 1),(),(1211nnP5. 对“aU(T, )b”作等价变形,得到如下形式: 可见,确定区间估计很关键的是要寻找一个待估参数 和估计量T 的函数U(T, ), 且U(T, )的分布为已知, 不依赖于任何未知参数 . 而这与总体分布有关,所以,总体分布的形式是总体分布的形式是否已知,是怎样的类型,至关重要否已知,是怎样的类型,至关重要. 需要指出的是,给定样本,给定置信水平 ,置信区间也不是唯一不是唯一的的. .对同一个参数,我们可以构造许多置信区间.,2已知 例如,例如,设 是取自 的样本 , 求参数 的置信水平为 的置 1N(0, 1)nU0.95 信区间. 由

28、标准正态分布表,对任意a、b,我们可以求得 P( aUb) .),(2Nn,21N(0, 1)nU例如,例如,由P(-1.96U1.96)=0.95)(ufu96. 196. 195. 0我们得到我们得到均值均值 的置信水平为的置信水平为 1的的置信区间为置信区间为0.95 96. 1,96. 1nn由由 P(-1.75U2.33)=0.95这个区间比前面一个要长一些这个区间比前面一个要长一些. .)(ufu33. 275. 1置信区间为置信区间为我们得到我们得到均值均值 的置信水平为的置信水平为 1的的0.95 33. 2,75. 1nn我们总是希望置信区间尽可能短我们总是希望置信区间尽可能

29、短. . 类似地,我们可得到若干个不同的置信区间. 任意两个数a和b,只要它们的纵标包含f(u)下95%的面积,就确定一个95%的置信区间.0buuu)(ufaaabb950.950.950.在概率密度为单峰且对称的情形,当a =-b时求得的置信区间的长度为最短.0buuu)(ufaaabb950.950.950.a =-b 即使在概率密度不对称的情形,如 分布分布,F分布分布,习惯上仍取对称的分位点来计算未知参数的置信区间.2 我们可以得到未知参数的的任何置信水平小于 1 的置信区间,并且置信水平越高,相应的置信区间平均长度越长.212( )n22( )n)(xfx)(2nX 也就是说,要想

30、得到的区间估计可靠度高,区间长度越长,估计的精度就差.这是一对矛盾. 实用中应在保证足够可靠的前提下,尽量使得区间的长度短一些 .三、 正态总体下的区间估计 进行区间估计下对,在置信度设1),(12N已知2) 1 (由前面推导过程可知, ),(2211unun 的置信区间为:的1未知2)2(取统计量 ) 1(/ntnST对于对于给定的置信度1,查t分布表,使1|21tTP从而, 12211tnStnSP1于是得到一个的置信区间),(2211tnStnS3300201. 2123 .3753057)11(2820201. 2123 .3753057)11(, 3 .375)3057(111,30

31、57975. 0975. 01212tnsxtnsxxsxii因而得到初生男婴平均体重的95%置信区间为(2820,3300)进行区间估计下对,在置信度221),(2N未知) 1 (niinS12)(112所以取样本函数 )1()1(222*nSn12对于对于给定的置信度,查 分布表,使1221P即 1) 1() 1(12*222*SnSnP21于是得的 置信区间 1222) 1(,) 1(SnSn取 ),1(212n),1(2122n有 ) 1() 1(,) 1() 1(2222122nSnnSn从而, 的置信区间为 ) 1(1,) 1(122221nSnnSn已知)2(函数 )()(221

32、22nnii的置信区间为:的12)()(,)()(212211222nnniinii(进行区间估计对21222211),(),(3NN已知21,) 1 (12221212()(0,1)UNnn取函数 的置信区间为:的121,(22212121nnu)22212121nnu222121,)2(但知未知)2()11(212121nntnnSU的置信区间为:的121,(212111nnSt)212111nnSt进行区间估计对2221222211),(),(4NN未知当21,) 1, 1(21222211nnFSSF的置信区间为:的12221) 1, 1(1,) 1,(1(212121211122SS

33、nnFSSnnF例3 为比较两个小麦品种的产量,选择18块条件相似的试验田,采用相同的耕作方法做试验,结果播种甲品种的8块试验田的单位面积产量和播种乙品种的10块试验田的单位面积产量(单位:kg)分别为:甲品种 628 583 510 554 612 523 530 615乙品种 535 433 398 470 567 480 498 560 503 426假定每个品种的单位面积产量均服从正态分布,试求这两个品种平均单位面积产量差的置信区间。 05. 0解解: : 设两种品种的产量分别 ,),(),(222211NN(1)先检验两种产量的方差是否相等1假设 22210:H22211:H2取检验

34、统计量 2221SSF由已给数据算得 8,55.2140,38.569112nSx10,22.3256,00.487222nSy657. 022.325655.214022210SSF3对于 05. 0查F分布表的 20. 4)9 , 7(975. 0F207. 082. 41)7 , 9(1)9 , 7(975. 0025. 0FF4 因为 ),9 , 7(657. 0)9 , 7(975. 00025. 0FFF所以接受.0H 可以认为2221 (2) 求置信区间 在 成立的条件下,0H的置信区间为:的121,(212111nnSt)212111nnSt99.275421121221122

35、2nnSnSnS488.5299.2754s1199. 2)16(975. 0t78.5210181488.521199. 211)16(21975. 0nnst的置信区间为:的故%952116.135,60.2978.5248738.569三、单侧置信区间 上述置信区间中置信限都是双侧的,但对于上述置信区间中置信限都是双侧的,但对于有些实际问题,人们关心的只是参数在一个方向有些实际问题,人们关心的只是参数在一个方向的界限的界限. 例如对于设备、元件的使用寿命来说,平均寿命过长没什么问题,过短就有问题了. 这时这时, 可将置信上限取为可将置信上限取为+ ,而,而只着眼于置信下限只着眼于置信下限

36、 ,这样求得的,这样求得的置信区间叫置信区间叫单侧置信区间单侧置信区间.于是引入单侧置信区间和置信限的定义:定义 对于给定的 (0 50 ).n,21),(1pnBnii) 1 , 0()1 ()(Npppn(近似)2211()()1(1)npPuupp 2221()0(1)npupp22222211()(2)0nupnupn所以参数 p 的置信区间为( p1, p2 )令2222211(),(2),anubnucn aacbbpaacbbp24,242221例6 自一大批产品中抽取100个样品,其中有60个一级品, 求这批产品的一级品率 p 的置信度为0.95的置信区间.p 的置信区间为解9

37、6. 1,05. 0,6 . 0,100025. 0uxn84.10396. 11002a366 . 01002c84.123)96. 16 . 01002(2b)69. 0,50. 0(),(21pp课堂练习课堂练习非参数检验:指总体分布不要求服从正态分布或总体分布情况不明时,用来检验数据资料是否来自某一个总体的统计检验方法。7.4 7.4 非参数的假设检验非参数的假设检验目的:用样本去检验总体的具体分布形式。分布拟合优度检验拟合总体的分布函数拟合总体的概率函数通常非参数统计方法适用于以下几种情况:n未知分布型,或样本数太少(n6)而使得分布状况尚未显示出来;n非参数性,只能以严重程度、优劣

38、等级、 效果大小、名次先后以及综合判断等方式记录其符号或等级;n分布程度偏态;n组内个别随机变量偏离过大。一、 概率纸法 直观、简便的方法。 1、 正态概率纸法 正态分布是最常用的分布,用来判断总体分布是否为正态分布的检验方法称为正态性检验,它在实际问题中大量使用。正态概率纸可用来作正态性检验。2、 正态概率纸法原理 设总体检验假设的分布函数为。xF)(),()(:),()(:2120NxFHNxFH做变换 )(u易知 ).1 , 0()(Nu所以有 。xuxxF)()()(把 ) 1()(,(见图一张概率纸。画在平面上。从而构成xFx)(2121)(22)(222xduedtexFuxtx即

39、 xF)(1xu图1 原理总结:利用样本数据在概率纸上描点,用目测方法看这些点是否在一条直线附近,若是的话,可以认为该数据来自正态总体,若明显不在一条直线附近,则认为该数据来自非正态总体。3、 正态概率纸法步骤 例例1 随机选取10个零件,测得其直径与标准尺寸的偏差如下:(单位:丝) 9.4 8.8 9.6 10.2 10.1 7.2 11.1 8.2 8.6 9.6 在正态概率纸上作图步骤如下:)(10)(11xFxxxxxnkxxxFnkkn(1) 首先将数据排序: 7.2 8.2 8.6 8.8 9.4 9.6(2) 10.1 10.2 11.1(2) 对每一个观测值,计算频率: )1(

40、x)(mx1r)(xFnnr1)2(x2rmrnrr211)(21)(nrrrxFkkn采用修正频率:(3) 将点 逐一点在正态概率纸上;(4) 观察上述n个点的分布. 若诸点在一条直线附近,则认为该批数据来自正态总体; 若诸点明显不在一条直线附近,则认为该批数据的总体不是正态分布。 nixFxkni, 2 , 1),(,()()( 从图2可以看到,10个点基本在一条直线附近,故可认为直径与标准尺寸的偏差服从正态分布。 图2 4、 正态概率纸的参数估计),()(xxF因为所以取, 5 . 0)(xF则.0 xx另外,取,8413. 0)(xF则xx1 如果从正态概率纸上确认总体是非正态分布时,

41、可对原始数据进行变换后再在正态概率纸上描点,若变换后的点在正态概率纸上近似在一条直线附近,则可以认为变换后的数据来自正态分布,这样的变换称为正态性变换。常用的正态性变换有三个:1)对数变换 ;xylnxy1xy 2)倒数变换 ;5、正态性变换3)根号变换 。例2 随机抽取某种电子元件10个,测得其寿命数据如下:110.47, 99.16, 97.04, 32.62, 2269.82,539.35, 179.49, 782.93, 561.10, 286.80.图3 给出这10个点在正态概率纸上的图形,这10个点明显不在一条直线附近,所以可以认为该电子元件的寿命的分布不是正态分布。图3 例2的正

42、态概率纸对该10个寿命数据作对数变换,结果见表4。)(lnix)(ix1 32.623.4849 0.061 6286.80 5.6588 0.5492 97.04 4.5752 0.159 7539.35 6.2904 0.6463 99.16 4.5967 0.256 8561.10 6.3299 0.7434 110.47 4.7048 0.354 9 782.936.6630 0.8415 179.49 5.1901 0.451 10 2269.82 7.7275 0.939ii( ) ix( ) ix( )lnix( )lnix0.3750.25in0.3750.25in)(ln)(

43、inxF)(lnix)(ix)(ln)(inxF表4. 对数变换后的数据 利用表4中最后两列上的数据在正态概率纸上描点,结果见图4,从图上可以看到10个点近似在一条直线附近,说明对数变换后的数据可以看成来自正态分布。这也意味着,原始数据服从对数正态分布.图4 变换后数据的正态概率纸 在前面的讨论中,概率纸虽然直观简单,但是对参数估计的精度不高,尤其是无法评价犯错误的概率。从而,无法控制犯错误的概率。二、卡方拟合优度检验 解决这类问题的方法最早由英国统计学家 K. Pearson (皮尔逊) 于1900年在他发表的一篇文章中给出, 该方法后被称为 Pearson2检验法,简称2检验。 这是一项非

44、常重要的工作,许多学者视它为近代统计学的开端。判断样本观察频数(Observed frequency)与理论(期望)频数(Expected frequency )之差是否由抽样误差所引起。 原理 不妨设总体 是连续型分布。检验步骤如下: 将总体 的取值范围分成 k 个互不重叠的小区 间 I1, I2, , Ik,. , ,( , , ,( , ,(12101212101kkkkkaaaaaaaIaaIaaI(2) 计算各子区间 Ii 上的理论频数。如果总体的分布函数为F(x, ),那么每个点落在区间 Ii 上的概率均为,k.,iaFaFPiii21 ),(),()(1)(inp n 个点中,理

45、论上有n pi ( )个点落在 Ii 上, (称为理论频数)。当分布函数中含有未知参数 时,理论频数也未知, 要用来估计 n pi ( ),其中 为 的极大似然估。(3) 计算各子区间 Ii 上的实际频数 ni 。 ni = x1, x2, , xn Ii , i=1, 2, , k . 计数符号,取集合中元素的个数 )()(122,kiiiinpnpn(4) 计算理论频数与实际频数的偏差平方和。可以证明:在 H0 成立,且 n时, 和式中的影响力。频数比较大的那些项在理论去除的其目的是:缩小每一项用 )( inp 212,k-r- 1 22是参数个数。是子区间数,分布,的由度为统计量的分布收

46、敛到自即rkrk(5) H0 的显著性水平为 的检验的拒绝域为 )( 212,k-r- 注:该检验方法是在 n 充分大时使用的,因而,使用时要注意 n 必须足够地大, 以及 npi 不能太小这两个条件。 在实用上,一般要求 n 50,以及所有npi 5。如果初始子区间划分不满足后一个条件, 则适当地将某些子区间合并,可使 npi 满足上述要求。 例例3 卢瑟福在2608个等时间间隔内观测一枚放射性物质放射的粒子数X,下表是观测结果的汇总,其中ni表示2608次观测中放射粒子数为i的次数。试利用该组数据检验该放射物质在单位时间内放射出的粒子数是否服从泊松分布。 ni 57 203 383 525

47、 532 408 273 139 45 27 10 6i 0 1 2 3 4 5 6 7 8 9 10 11解:本例中,要检验总体是否服从泊松分布。观测到 0, 1, , 11 共 12 个不同取值,这相当于把总体分成12类。这里有一个未知参数 ,采用极大似然估计, 11 203 2 383 . 11 63.8702608 =将 代入可以估计出诸 。于是可计算出 ,列表如下。ip2012345678910115720338352553240827313945271060.02090.08070.15620.20150.19500.15090.09730.05380.02600.01120.00

48、430.002254.5210.5407.4525.5508.6393.5253.8140.367.829.211.25.70.11470.26721.46140.00051.07660.53431.45250.01207.66730.16580.12580.0158合计26081.00002068 =12.89672iniipinp2/iiinnpnpinip ipniiipnpnn/)(22 若取=0.05,则211k r 20.951018.307. 本例中 2 =12.896718.307,故接受原假设。使用统计软件可以计算出此处检验的p 值是0.2295。例例4:某医院一年中出生的婴

49、儿共计1521人,其中男婴802人,女婴719人。给定 =0.05,试问:能否认为男婴、女婴出生概率相同?解:用X 表示服从两点分布的随机变量,X 取0, 1两个值,X=1表示男婴,X=0表是女婴。则问题就是检验假设 H0:p1 = PX=0=0.5.(1) 将 (-, ) 分成两个区间 . ) 0.5( ,0.5 (21,II 计算每个区间上的理论频数。因为两个区间上 的理论概率 p1= p2=0.5, 而 n=1521, 故 . 5 .6075 . 0152121 npnp(3) 各区间上实际频数:n1=802, n2=719 .(4) 计算统计量的值.529. 4 5 .760) 5 .

50、760719(5 .760) 5 .760802(222.841. 3)05. 0()(529. 4 0.05 2 21212k-k,因为(5) H0 的显著性水平为的检验 所以,拒绝原假设,即认为男婴女婴出生概率有显著差异。. 473. 01 527. 01521802 12211ppppp的估计为女婴出生概率;的估计为男婴出生概率三、科尔莫哥洛夫检验 卡方检验法的问题1)分组不同,拟合的结果可能不同;2)需要有足够的样本含量;3)对于连续型变量的优度拟合,卡方检验并不是理想的方法。 统计学家推荐的拟合检验方法是:1)Shapiro-Wilk检验2)Kolmogorov-Smirnov检验思

51、想:比较实际频数与理论频数的累积概率间的差距,找出最大距离D,根据D值来判断实际频数分布是否服从理论频数分布。科尔莫哥洛夫检验的步骤:1)把字样观测值从小到大进行排序;2)算出经验分布函数)(10)(11xFxxxxxnkxxxFnkkn3)在原假设H0下,计算观测值处的理论分布函数;4)计算经验分布函数和理论分布函数的差的绝对值;| )()(| )()(|)()1()()(iiniinxFxFxFxF与5)计算统计量的值;|)()(|, | )()(|sup)()1()()(iiniinxnxFxFxFxFD6)给出显著水平 ;由科尔莫哥洛夫检验的临界值表查出:)(,nnDDP7)由(5)算

52、出的 , 则拒绝原假设,否则接受原假设。,nnDD 四、 秩和检验秩和即秩次的和或等级之和。秩和检验法也叫Mann-Whitney-Wilcoxon检验,它常被译为曼惠特尼维尔克松检验,简称M-W-W检验,也称Mann-Whitney Z检验。1、适用资料1)秩和检验法与参数检验法中独立样本的t检验法相对应。当“总体正态”这一前提不成立时,不能用t检验,可以用秩和检验法;2)当两个样本都为定序(顺序)变量时,也需使用秩和法进行差异显著性检验。2、 秩和检验的步骤1)小样本:两个样本容量均小于10(n110,n210)(1)将两个样本数据混合由小到大排列秩次(如果大小相同就计算它们的平均秩次);

53、(2)把样本容量较小的样本中各数据的秩次相加,以T表示;(3)建立假设H0:A = B H1:A B(4)检验把T值与秩和检验表中的临界值比较T T1或T T2,则表明两样本差异显著;T1 T T2,则意味着两样本差异不显著。例5 医学院试验两种新药治疗贫血病人,两个月后病人的红细胞数(万/毫米3)增加的秩次如下表,试问这两种新药有无显著性差异?(=0.05)解:T = 1+2+3+6+8+8 = 28. 查表,n1 = 6, n2 = 8, = 0.05 (双测), c1 = 29, c2 = 61因为:T 10, n210)。可以证明,当n时,T就趋向正态分布,此时,秩和T的分布接近正态分

54、布,可以进行Z检验。其平均数和标准差如下:1121212112/20112112,|,TTTTn nnn nnnnnnTZZzHH其中 为较小的样本容量,即双侧检验,若|接受;反之接受。例6 有两个水稻品系A与B,分别在10块试验田中作栽培试验,得产量如下表,试问它们的平均产量有无显著性差异?(=0.05)12:,186.5, 232.5, 24.1, 1.91,TTnnTTZ 解 将两组数据混合并从小到大排列等级 分别标出等级。取秩和小的那一组B的秩和为 ,所以可以认为A,B无显著差异。是否痊愈 服何种药引例 某研究所推出一种感冒特效药,为证明其疗效,选择200名患者为志愿者。将他们均分为两组,分别不服药或服药,观察 三日后痊愈的情况,得出下列数据问:新药是否有效?五 、 列联表的独立性检验 列联表是将观测数据按两个或更多属性(定性变量) 分类时所列出的频数表。例如,对随机抽取的1000人按性别(男或女)及色觉(正常或色盲) 两个属性分类,得到如下二维列联表,又称22表或四格表。 一般,若总体中的个体可按两个属性A与B分类,A 有r 个类 ,B 有c个类 从总体中抽取大小为n的样本,设其中有 个个

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论