统计学基础(六套卷)_第1页
统计学基础(六套卷)_第2页
统计学基础(六套卷)_第3页
统计学基础(六套卷)_第4页
统计学基础(六套卷)_第5页
已阅读5页,还剩20页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

第一套一、填空1.统计数据的直接来源主要有两个渠道:一是;二是。2.统计的含义包括三个方面,它们是。3.按照计量层次分类,统计数据可以分为:。4.按照时间状况分类,统计数据可以分为:。5.按照收集方法分类,统计数据可以分为:。6.8、9、12、7、11、13、9、11、8、10以上10个数据的平均数是,中位数是,方差是。7.在大样本的检验方法中,当总体方差未知时,可以用样本方差来近似代替总体方差,此时总体均值检验的统计量为:。8.判定系数(请用表示)。9.一般将时间序列的构成要素分成四种,即。10.已知为报告期的销售额,是对个体的价格指数,则价格指数的加权平均调和形式的计算公式为:。二、单项选择1.下列数据属于品质数据的是()A.顺序数据B.截面数据C.观测数据D.实验数据2.对一批小麦种子进行发芽率试验,这时总体是()A该批小麦种子B该批小麦的发芽率C该批小麦中发芽的种子D该批小麦的发芽率3.已知均值为,方差为的总体中,抽取容量为的随机样本,当充分大时,样本的均值和方差近似等于()A.B.C.D.4.下列散点图中表示非线性相关的图为()ABCD5.在右侧检验中,利用值进行检验时,拒绝原假设的条件是()A.B.C.D.三、判断题1.分层抽样除了可以对总体进行估计外,还可以对各层的子总体进行估计。2.平均指标反映了现象总体的规模和一般水平,但掩盖了总体各单位的差异情况,因此通过平均指标不能全面认识总体的特征。()3.总体分布为非正态分布而样本均值可能为正态分布。()4.抽样误差由于事先可以进行控制或计算的,所以这类误差通常是可以消除的。()5.在单独求一组数据计算标准差时,公式下方虚线处应为四、简答题1.河南大学数学院为了增加学生们的学习积极性,推行了一套新的制度,通过一学期的试行,由最终的成绩决定是否继续执行。(1)发生第一类错误是指什么,造成什么影响?(2)发生第二类错误是指什么,造成什么影响?2.请简述样本容量为的数据的四分位数的计算方法。五、计算题1.某车间工人日生产零件分组资料如下:零件分组(个)工人数(人)40-5050-6060-7070-8080-902040805010合计200试计算零件的平均日产量.2.某车间有甲、乙两个生产组,甲组平均每个工人的日产量为36件,标准差为9.6件;乙组工人日产量资料如下:

日产量(件)

工人数(人)

15

15

253835344513

要求:⑴计算乙组平均每个工人的日产量和标准差;

⑵比较甲、乙两生产小组哪个组的日产量更

有代表性?3.某居民小区为研究职工上班从家到单位的距离,抽取16个人组成随机样本,他们的样本分别为:10、3、14、8、6、9、12、11、7、5、10、15、9、16、13、2假定总体服从正态分布,求职工从家到单位的平均距离的95%的置信区间。(;;;)4.已知某种机器的使用寿命服从正太分布,现从一批机器中随机抽取16台,测得其使用寿命(单位:天)如下:1510145014801460152014801490146014801510153014701500152015101470试建立该批机器平均使用寿命的95%的置信区间(;;;)。5.2012年河南大学百年校庆所制作的校徽,每个的直径为30mm,标准差为3mm,为检验每个校徽是否符合标准要求,学校负责检查的老师从这一批校徽中随机抽取了50个进行测量,测得每个平均值为31mm,去显著水平α=0.05,检验该批次校徽是否符合标准。参考答案一、填空1.调查或观察实验2.统计实践、统计资料、统计科学3.分类数据、顺序数据、数值型数据4.截面数据、时间序列数据5.观测数据、实验数据6.9.89.53.367.8.9.趋势性、季节性、周期性、随机性10.二、单项选择1.A2.A3.D4.A5.C三、判断题1.√2.√3.√4.×5.×四、简答题1.答:(1)第一类错误是成绩未提高,但是误以为提高了,不能提高成绩。(2)第二类错误是成绩提高了,误以为没有提高,不能用新制度来提高成绩计算。2.答:①针对未分组数值型数据:下四分位数在位中四分位数在位上四分位数在位②针对顺序型数据和分组数据下四分位数在位中四分位数在位上四分位数在位五、计算题1.解:零件分组(个)工人数(人)组中值x标志总量xf40-5050-6060-7070-8080-9020408050104555657585900220052003750850合计200-129002解:(1)(2)3解:由样本数据得:4.解:由样本数据得:5.解:第二套一、填空题。1.统计学是________、________、________、________、并从数据中得出结论的科学。2.数据的预处理包括数据的________、________、和________目的是通过对数据的初步加工为进一步整理奠定基础。3.数据分布的特征主要从三个方面进行测度和描述:一是________二是________三是________。4. 对于大量的数据而言,平均数,中位数(),众数(),如果该数据存在明显的左偏分布,此时之间的位置代表值的大小关系为________。5.已知样本容量为2的样本,,则的均值等于________=__。6.一个的样本总体,近似服从期望为,方差为的正态分布,当总体方差未知时,总体均值在的置信水平下的置信区间为________。7、一家公司在招收职员时,首先要通过两项能力测试。在A项测试中,其平均分数是100分,标准差是15分;在B项测试中,其平均分数是400分,标准差是50分。一位应试者在A项测试中的了115分,在B向测试中得了425分。与平均分数比,这位应试者项成绩更为理想。8.区间估计的类型有________、________。9.时间序列的构成要素:________、________、________、________。10.加权指数因所采用的权数不同可以分为________、________等不同的形式。二、单项选择题。1.下列哪一个是分类变量()A.年龄B.性别C.汽车产量D.员工对企业某项改革措施的态度(赞成、中立、反对)2.按连续型变量分组,其末组为开口组,下限为2000。已知相邻组的组中值为1750,则末组组中值为(C)A.2100B.2200C.2250D.25003. 根据以往的生产统计,某种产品的合格率为,估计误差求在的置信区间内抽取的样本量=()A.B.C.D.4.某工厂生产一种灯泡,这种灯泡的使用年限不超过8年,现产品开发小组研究了一种新的生产方案,他们认为灯泡的使用年限得到了提高,在对新产品进行检验时,应采取哪种形式的假设?()A.B.C.D.以上都不对5.从某种瓶装饮料中随机抽取十瓶,测得每瓶的平均净含量为355毫升。已知该饮料的净含量服从正态分布,并且标准差为5毫升。则该种饮料平均净含量的90%的置信区间为()A.

B.C.D.三、判断题。1.直方图可以看出数据的分类,又能给出每一个原始数值()2.根据对四分位的理解四分位的位置的是()3.相关系数为+1时,说明两变量完全相关,相关系数为-1时,说明两个变量不相关。()4.定基增长率的计算公式为()5.在假设检验中,如果样本容量一定,则犯第一类错误和犯第二类错误的概率不可能同时减小。()四、简答题。1.简述数值型数据的分组步骤,并说明在不同的情况下我们分别使用哪些图来显示数值型数据的分布特征。2.某一小麦品种的平均产量为5200kg/hm^2,一家研究机构希望对小麦品种进行改良,通过试验的产量数据来判断改良是否有效进而决定是否推行改良后品种(1) 在这种情况下,发生第Ⅰ类错误指的是什么,将导致什么后果?(2) 在这种情形下,发生第Ⅱ类错误指的是什么?将会导致什么后果?五、计算题。1.将某邮局中外发邮包样本的重量近似到盎司为:2,4,7,10,10,10,12,12,14,15。①.计算这组数据的中位数和四分位数。②.根据定义公式计算样本的标准差。③.并根据所计算的数值判断该数据的分布情况。2.从一批零件中抽取9件,测得其直径为19.720.119.819.920.220.019.920.220.3假设零件的直径服从正态分布,试估计该批零件直径均值的置信区间,置信水平为。3.据统计,某大学教师中女教师所占的比例为65%,现要求估计误差为5%,在求95%的置信区间时,应抽取多少名教师作为样本。4.按规定,某种绳子的平均拉断力必须大于18.3kg才算合格,现买了一部新机器来制造这种绳子,从其产品中抽出100件,测得平均拉断力为18.1kg,假设绳子的拉断力服从标准差为的正态分布,问这部机器生产的产品合格吗?()5.某校声称高中生考入本科院校的比例为80%,为此教育部对2013年该校200名毕业生的升学情况做了调查,其中,有146人顺利考入本科院校,对于该校的论断,你有什么看法?()参考答案一、填空题。1.收集、处理、分析、解释数据2.审核筛选排序3.分布的集中趋势分布的离散程度分布的形状4.5.226.7.A8.置信区间估计预测区间估计9.趋势(T)季节性(S)周期性(C)随机性(I)10.加权综合指数加权平均指数二、单项选择题1.B2.C3.A4.A5.D三、判断题。1.×2.×3.×4.×5.√四、简答题1.数值型数据的分组步骤:第一步:确定组数;第二步:确定各组的组距;第三步:统计出各组的频数即为频数分布表。对于分组后的数据通常使用直方图来显示其分布特征。对于未分组的原始数据通常使用茎叶图和箱线图来显示其分布特征。对于多变量的数据通常使用雷达图来显示其分布特征。2.:改良没有效果:改良有效(1) 发生第Ⅰ类错误指的是实际上改良后的产品不能提高产量,但研究机构错误的认为改良产品是有效的,从而推行改良后的产品,却没有办法获得更高的产量(2) 发生第Ⅱ类错误指的是实际上改良后的产品能够高产量,但研究机构却没有认识到,从而没有推行改良后的种子,也就无法进一步提高产量。五、计算题。1.①.中位数10四分位数②.标准差③.右偏分布2.置信区间为:(19.8520.17)3.

4. 检验统计量为:故接受,认为该部机器生产的产品合格5.检验统计量为:第三套(无答案)一填空题只能归于某一类别的非数字型数据,称为()条形图主要用于展示(),而直方图主要用于展示()在一个企业中随机抽取8名员工得到每个员工的月工资收入数据如下(单位:元):1600750760108085096012501500该组数据75%四分位数的位置为()75%四分位数的值为()设总体X的方差为1,从总体中随机取容量为36的样本,得样本均值=4,则总体均值的置信水平为95℅的置信区间()某市2000—2005年间玉米产量(万吨)配合的直线趋势方程Y=800+5.5t式中时间变量t=—5、—3、—1、1、3、5根据上面的直线趋势方程预测2006年玉米产量为()某企业07年与06年相比各种产品产量增长了8%,总生产费用增长了15%,则该企业07年单位成本指数()周期超市营业额常常会大大高于平日数额,这种波动属于()时间序列分为()和()两大类、9.设总体X~,为样本均值,S为样本标准差,当未知,且为小样本时,则服从自由度为n-1的()分布10.若时间序列有20年的数据,采用5年移动平均,修匀后的时间序列中剩下的数据有()个二.选择题1.若某总体次数分布呈左偏分布,则成立的有()A>>B<<C>>D<<2.一名统计学专业的学生为了完成其统计作业,在《统计年鉴》中找到的1995年城镇家庭的人均收入数据。这一数据属于()A分类数据B截面数据C顺序数据D时间序列数据3.在假设检验中,若此检验是()A左侧检验B右侧检验C双侧检验D单侧检验4.在回归分析中,描述因变量如何依赖自变量和误差项的方程称为()A回归方程B回归模型C估计的回归方程D理论回归方程5.在下列指数中,属于质量指数的是()A产量指数B单位产品成本指数C生产工时指数D销售量指数三.判断题.1.用来描述样本特征的概括性数字度量称为参数.()2.茎叶图主要用于顺序型数据的显示.()3.在设计调查问卷的回答项目时,封闭性问题的答案往往是自由回答型,所以设计出的答案一定要穷尽和互斥.()4.移动平均不仅能消除季节变动,还能消除不规则变动.()5.r=0说明两个变量之间不存在相关关系.() 四.简答题.1.某公司去年的总投资收益为5千万,现公司的董事长为提高公司的收益率投资了一项新的项目,通过执行项目初期的收益数据来决定该项目是否能够提高公司的收益率。(1)在这种情形下,发生第一类错误指的是什么?将会导致怎样的后果?(2)在这种情形下,发生第二类错误指的是什么?将会导致怎样的后果?2.直方图与条形图有什么区别五.计算题。1.对某企业抽取的100名员工按每月工资进行分组,结果如下:计算100名员工每月工资的平均数和中位数。2.一家食品生产企业以生产袋装食品为主,按规定每袋的标准重量应为100克,企业质检部门从某天生产的一批食品中随机抽取50袋进行检查,测得结果如下表:已知该食品质量服从正态分布,要求:确定该食品平均重量的90℅的置信区间。若规定食品重量低于100克属于不合格,请确定该食品合格率的90℅的置信区间。3.某投资商的每月投资盈利的标准差为2000元,若想要估计盈利99℅的置信区间且允许的估计误差不超过200元,则应抽取多大的样本容量。4一般来说,如果能够证明某部电视剧在播出的头13周中观众的收视率超过了30%,则可以认为它获得了成功:现针对一步关于农村生活题材电视剧抽选了500个家庭组成一个样本,发现头13周理由170个家庭看过这部电视剧。建立适当的原假设与备择假设如果允许发生第一类错误的最大概率为0.01,那么能否凭这些信息断定这部电视剧的成功5.为了检验洗衣液的洗衣效果,当80%被洗干净时即认为效果很好选了36件衣服进行清洗,发现有30件衣服清洗干净,显著性水平分别取a=0.05和a=0.01检验该洗衣液清洗衣服的干净度是否为80%第四套填空题(10个小题)统计分组的原则___、____。数据预处理包括:___、____、____。将构造置信区间的步骤重复多次,置信区间中包含总体参数真值次数所占的比率为____。变量之间的关系形态分为:___、____。参数是用来描述___的概括性数字度量,统计量是用来描述___的概括性数字度量___。非平稳序列包含___、___、___、___的序列。相关系数r的取值范围是___当所有的观察值都落在回归直线y=a+bx,x与y的相关系数为___检验统计量P值是我们犯错误的___。假设检验中两类错误可以由研究者控制的是___。回归分析中显著性检验包括一是:______二是:______。选择题(5个小题)1.1不属于统计学研究方法的是()A大量观察法B综合指标法C统计验证法D统计推断法2.下列描述错误的是()A平均数易受到极端值的影响,而中位数和众数不会。B直方图用矩形的面积来表示频数分布。C调查问卷的结构顺序应具有逻辑性,先易后难。D选取统计数据时,可随意选取其他二手数据。3.下面的陈述(

)是错误的。A.抽样误差可以避免

B.非抽样误差可以避免C.抽样误差不可避免

D.抽样误差可以控制4.设(a,b)是未知参数u的置信度为1-α的置信区间,则下列说法正确的是()Au落入区间(a,b)的概率为1-αBu落入区间(a,b)的概率为αC(a,b)包含u的可信度程度为1-αD(a,b)包含u的可信度程度为α5.某工厂新工人工资400元,工资总额为200000元,老工人月工资800,工资总额为80000元,则平均工资为()A600B533.33C466.67D800判断题(5个小题)进行数据分组时,若存在开口组,则以相邻组的组距为准。()一组数据处于中间位置上的变量值成为中位数()当原假设为真时舍弃原假设,为犯第二类错误的概率()当相关系数r=0表示两个变量之间不存在相关关系()对于同一变量分布,其标准差永远小于平均差()简答题:(2个小题)某市第一高级中学平均每年的升学率为70%,该学校的校长建议采用新的教学方案,通过观察实行一年后的升学率来决定新的教学方案是否能提高该校的升学率。在这种情形下,发生第类І错误指的是什么?将会导致怎样的后果?在这种情形下,发生第ІІ类错误指的是什么?将会导致怎样的后果?简述相关关系与判定系数的关系:计算题(5个小题)1.设一个物体的重量∪未知,为估计其重量用天平去称量。由于称量是有误差的,因而结果是一个随机变量,通常服从正态分布。用天平称量的标准误差为0.1克时,可以认为称量结果服从N(µ,0.1²)。现将物体称了五次,结果如下5.525.485.645.515.45试求物体的重量µ作置信水平为0.95的区间估计。2.

请根据下表已知数据完成表格。按销售收入分组(万元)企业数(个)频率(%)向上累积企业数频率100以下

12.5

100~110922.5

110~12012

120~130

17.5

130~1404

140以上

7.5100.0合计40100.0——对10名成年人和10名幼儿的身高(单位:cm)进行抽样调查如下:成人组:166169172177180170172174168173幼儿组:68696870717372737475(1).要比较成年组和幼儿组的身高差异,你会采用什么样的统计量?问什么?(2).比较分析哪一组的身高差异大?4.下面列出的是某工厂随机选取的20只部件的装配时间9.810.49.29.69.710.110.29.49.99.610.39.39.910.69.710.59.810.19.610.2该装备时间服从正态分布,其方差σ²=0.39²,去显著水平α=0.05,是否可以认为装配时间的均值显著地小于10?5.某居民小区共有居民500户,小区管理者准备更换一种新的供水设施,想了解居民是否赞成。采取重复抽样方法随机抽取50户,其中32户赞成,18户反对。求总体中赞成更换的户数比例的置信区间,置信水平为95‰如果小区管理者预计赞成的比例能达到80%,估计误差不超过10%,应抽取多少户进行检验?参考答案一:1.穷尽性、互斥性2.审核筛选排序3.置信水平4.函数关系和相关关系5.总体特征、样本特征6.趋势性、季节性、周期性、随机波动7.-1<=r<=1、r=-1或者r=18.实际概率9.第一类错误10.线性关系检验、回归系数检验二:1.C2.D3.A4.C5.C三:1.√2.×3.×4.×5.×四:1.解:(1):Hₒ:不能提高该校的升学H1:能提高该校的升学率发生第类І错误指的是实际新的教学方案不能提高该校的升学率,而校长却误认为它提高该校的升学率,这将导致该校错误的采用新的教学方案,却无法提高该校的升学率(2):发生第ІІ类错误指的是实际新的教学方案能提高该校的升学率,而校长没有意识到,这将导致该校错过采用新教学方案的机会,也就无法提高该校的升学率2.相关系输描述的是两个变量之间线性关系强度,-1≤r²≤1,|r|越接近1关系越亲密,判定定系数测度了回归直线对观测数据的拟合成度,反映了因变量y的总变差中由x与y之间线性关系所解释的比例,0≤R²≤1,越接近1表明只限与各观测点越接近。Ⅱ、相关系数公式:判定系数公式:Ⅲ、在一元线性回归中,r实际是R²的平方根,相关系数r与回归方程中参数β正负号相同,R²越大表明自变量与因变量线性关系越明显,或者说y的变动有R²个百分比是由自变量所揭示的,r也从另一个角度说明了回归直线的拟合优度,|r|越接近1表明拟合优度越高,但当用r说明回归直线的拟合优度时应谨慎因为r总是大于R²。五:1.【5.4325.608】2.按销售收入分组(万元)企业数(个)频率(%)向上累积企业数频率100以下

55

12.5100~11014

35.0110~120130

26

65120~130

73382.5

130~14010

37

92.5140以上3

40100.0合计40100.0——3.(1)应该采用离散系数,因为它消除了不同组数据水平高低的影响。(2)成年组身高的离散系数:Vs=4.2∕172.1=0.024幼儿组身高的离散系数:Vs=2.5∕71.3=0.0354.设H0:µ>10H1≤10样本数据x平均数等于9.895Z====1.204Z=1.204(/2)=1.645所以接受原假设,所以µ>105.(1):已知n=50P=32∕50=0.64,a=0.05,Z0.05∕2=1.96总体中赞成该项改革的户数比例的95%的置信区间为;【0.51,0.77】(2):已知:π=0.08,a=0.05,Z0.05∕2=1.96.应抽取的样本量为:n=(Z0.05∕2)•(Z0.05∕2)•π(1-π)∕E•E=62第五套一.填空题1.推断统计的内容包括_____和_____2.消费者对某种商品的满意程度(非常满意、满意、不满意)是_____变量3.数据的收集方法分为______和_____4.如果数据是明显的左偏分布,平均数、中位数,众数的大小关系为______5.要使犯第一类错误的概率α和犯第二类错误的概率β同时减小的唯一办法是______6.参数估计的方法有_____和_____7.备择假设通常用于_____你自己的看法8.变量之间的关系形态可分为_____和_____9.判定系数R^2测度了回归直线对观测数据的_____10.时间序列可以分为_____和_____二.单项选择1.某城市工业企业末安装设备普查,调查单位是()A)工业企业全部末安装设备B)工业企业每一台末安装的设备C)每个工业企业的末安装设备D)每一个工业企业2.有一批灯泡共1000箱,每箱200个,现随机抽取20箱,并检查这些箱中全部的灯泡,此检验属于()A.纯随机抽样B.分层抽样C.整群抽样D.等距抽样数据的预处理不包括()A、数据审核B、数据分布C、数据排序D、数据筛选4.直方图与条形图不同之处不包括()条形图中的每一矩形表示一个类别,奇宽度无意义,而直方图的宽度则表示各组的组距。B、由于分组数据具有连续性,直方图的各矩形通常是连续排印的,而条形图则是分开排列的。C、条形图主要用于展示定性数据,而直方图则主要用于展示定量数据。D、直方图完全包含条形图,即条形图是直方图的一个特殊形式。数据分布特征的测度内容不含()A、集中趋势的测度B、离散程度的测度C、偏态峰态的测度D、指数的测度三判断题只能归于某一类别的数字型数据称为分类数据()我们可以把总体看成是一群人或一些物品的集合()用来描述总体特征的概括性数字度量,称为统计量()平均差衡量均值代表性,平均差越大,数据越分散()如果一个总体本身是正态分布,这个总体的所有样本服从正态分布()构造置信区间的步骤重复多次,置信区间中包含样本参数真值的次数所占的比率,称为置信水平。()随机抽样中随机是指总体中每个单位被选为样本的几率是相等的()统计数据的误差通常是指统计数据与客观现实之间的误差,误差主要有抽样误差和非抽样误差两类()概率抽样是根据一个已知的概率来抽取样本单位()测定多个项目在不同场合下综合变动的相对数,称为指数()四、简答题1、简述回归系数显著性检验的步骤。2、某公司销售人员的平均工资为5000元,该公司的销售部门经理建议采取一项刺激消费的奖励计划来提高公司的消费情况,通过试行期的数据来决定该计划是否能提高该公司的销售情况。试回答,(1)提出原假设和备择假设;(2)写出这种情况下,发生第一类错误和第二类错误分别指的是什么,会带来什么后果?五.计算题1.下面是AB两班学生语文考试成绩数据:A班4457596061616263636566666769707071727373737474747575757575767677777778787980808285858686909292929396B班3539404444485152525455565657575758596061616263646668687070717173747479818283838485909191949596100100100将两个班考试成绩用一个公共的茎制成一个茎叶图比较两个班考试成绩分布的特点,并根据茎叶图说出哪个班成绩较好2.某国家足球队需要选拔队员,要进行两项体能测试。在A项测试中,其平均分数是100分,标准差是15分;在B项测试中,其平均分数是400分,标准差是50分。一位应征者在A项测试中得了115分,在B项测试中得了425分。与平均分数相比,该位应试者哪一项测试更为理想?3.在4000件成品中按不重复方法抽取200件进行检查,结果有8件废品,当当概率为0.9545(t=2)时,试估计这批成品废品量的范围。4.一般来说,如果能够证明某部电视剧在播出的头13周中观众的收视率超过了25%,则可以认为它获得了成功.现针对一部科幻题材的电视剧抽选了400个家庭组成一个样本,发现头13周里有112个家庭看过这部电视剧.(1)建立适当的原假设与备择假设.(2)如果允许发生第I类错误的最大概率为0.01,那么能否凭这些信息断定这部电视剧是成功的?5.一种汽车配件的平均长度要求为12cm,高于或低于该标准均被认为是不合格的。汽车生产企业在购进配件时,同城是通过招标,然后对中标的配件提供商提供的样品进行检验,以决定是否购进。现对一个配件提供商提供的10个样本进行了检验,结果如下:12.2 10.8 12.0 11.8 11.9 12.4 11.3 12.2 12.0 12.3嘉定该供货商生产的配件长度服从正态分布,在0.05的显著性水平下,检验该供货商提供的配件是否符合要求。参考答案一.选择题1-5:CCBDD二.判断题1-5错错错对对6-10错错对对对三.填空题1.参数估计、假设检验2.顺序3.询问调查、观察实验4.平均数<中位数<众数5.增大样本量6.点估计、区间估计7.支持8.函数关系、相关关系9.拟合优度10.平稳序列、非平稳序列四、简答题第一步:提出假设第二步:计算检验的统计量第三步:作出决策(1)原假设:该项措施能提高该公司的销售量备择假设:该项措施不能提高该公第一类错误指的是实际上奖励计划并未提高该公司的销售量,而公司的决策者却认为它提高了该公司的销售量,这将导致公司错误的推行新的奖励计划,却无法提高销售量的效果第二类错误指的是实际上奖励计划并提高了该公司的销售量,而公司的决策者却没有意识到,这将导致公司错过推行新的奖励计划的机会。第五题1.解:茎叶图A班树茎B班数据个数树叶树叶数据个数01211237604979766533211098877766555554443332100665520063222034567891059044812245667778901123468800113449123345011456000241298663(2)A班成绩分布较集中,且平均分高;B班成绩比A班分散,且平均成绩比A班低。A班较好。解:通过计算标准分数来判断ZA=(XA-Xa)/SA=1(其中xa为平均分数)同理ZB=0.5.该应征者在A项测试中比平均分数高出一个标准差,而在B项测试中只高出0.5个标准差,A项测试标准分数高于B项测试,所以A项测试比较理想。解:解:(1)Ho:p<=0.25H1:p>0.25如果np0和n(1-p0)都大于等于5.(2)z=QUOTE=1.39<z0.01(=2.33),不能拒绝原假设,因此没有充分理由认为这部电视剧是成功的解:依题意简历如下原假设与备择假设:H0:u=12 H1:u12根据样本数据计算得:=11.89,s=0.4932。由于n<30为小样本,故而采用式(6.4)计算检验统计量:根据自由度n-1=10-1=9,查t分布表得:,由于,所以不能拒绝原假设,样本通的证据表明,该供货商提供的零件符合要求。第六套一、填空1.某公司员工年龄的茎叶图如下:257314574356695224该公司员工年龄的众数(46)2.为比较多个样本间的相似性,适合采用的图形是(雷达图)3.为了调查某校学生的购书费用支出,从全校抽取4个班级学生进行调查,这种调查方法是(整群抽样)。4.用来描述样本特征的概括性数字度量称为(统计量)。5.从两个正态总体中分别抽取两个样本,则两个样本方差比的抽样分布近似服从(F)分布。6.时间序列呈现出的非固定长度的周期性变动称为(循环波动)。7.已知回归平方和SSR=420,残差平方和SSE=160,则判定系数R2=(0.62)。8.依据所采用的计量尺度的不同,统计数据可分为分类数据、(顺序数据)和(数值型数据)。9.设(,,……)为来自N(

)的简单随机重复抽样的样本,在已知

时,样本均值

~()。10.若样本方差(

)的期望值等于总体方差(),则称

的(无偏)估计量。二、选择1.某研究部门准备在全市100万个家庭中抽取1000个家庭,以推断该城市所有职工家庭的年人均收入。这项研究的样本是()。A.1000个家庭B.100万个家庭C.1000个家庭的人均收入D.100万个家庭的人均收入2.某班学生的平均成绩是80分,标准差是10分。如果已知该班学生的考试分数为对称分布,可以判断成绩在60-100分之间的学生大约占()。A.95%B.89%C.68%D.99%3.在方差分析中,用于度量自变量与因变量之间关系强度的统计量是R2,其计算方法是()。A.B.C.D.4.下面的相关系数取值哪个是错误的()。A.-0.86B.0.86C.1.86D.05.在一项犯罪研究中,收集到2010年的犯罪数据。在那些被判纵火罪的罪犯中,有200人是酗酒者,172人不喝酒;在那些被判诈骗罪的罪犯中,有252人是酗酒者,576人是戒酒者。在а=0.01的显著性水平下,检验“纵火犯中酗酒者的比例高于诈骗犯中酗酒者的比例”,建立的原假设和备择假设是()。A.H0:∏1-∏2≥0,H1:∏1-∏2<0B.H0:∏1-∏2≤0,H1:∏1-∏2>0C.H0:∏1-∏2=0,H1:∏1-∏2≠0D.H0:∏1-∏2<0,H1:∏1-∏2≥0四、判断1.当原假设为真时舍弃原假设,称为假设检验中的第一类错误。(t)2.利用最小二乘估计法计算的回归系数的估计值比用其他任何方法求得的估计值更接近总体回归系数的真值。(f)3.如果甲乙丙三个企业今年产量计划完成程度是95%、100%和105%,则这三个企业产量的平均计划完成程度为100%。(f

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论