用样本估计总体_第1页
用样本估计总体_第2页
用样本估计总体_第3页
用样本估计总体_第4页
用样本估计总体_第5页
已阅读5页,还剩9页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

用样本估计总体一、基础知识1.频率分布直方图频率 频率(1)纵轴表示组距,即小长方形的高= 组距;频率(2)小长方形的面积=组距× 组距=频率;(3)各个小方形的面积总和等于 1.2.频率分布表的画法极差第一步:求极差,决定组数和组距,组距= ;组数第二步:分组,通常对组内数值所在区间取左闭右开区间,最后一组取闭区间;第三步:登记频数,计算频率,列出频率分布表.3.茎叶图茎叶图是统计中用来表示数据的一种图,茎是指中间的一列数,叶就是从茎的旁边生长出来的数.4.中位数、众数、平均数的定义(1)中位数将一组数据按大小依次排列,处于最中间位置的一个数据 (或最中间两个数据的平均数 )叫做这组数据的中位数.(2)众数一组数据中出现次数最多的数据叫做这组数据的众数.(3)平均数一组数据的算术平均数即为这组数据的平均数, n个数据x1,x2,⋯,xn的平均数 x=1n(x1+x2+⋯+xn).5.样本的数字特征如果有n个数据x1,x2,⋯,xn,那么这 n个数的(1)平均数 x=1n(x1+x2+⋯+xn).12+x2-x2+⋯+xn-x2].(2)标准差s=[x1-xn2 1 2 2 2(3)方差s=[(x1-x)+(x2-x)+⋯+(xn-x)].二、常用结论1.频率分布直方图中的常见结论(1)众数的估计值为最高矩形的中点对应的横坐标.平均数的估计值等于频率分布直方图中每个小矩形的面积乘以小矩形底边中点的横坐标之和.(3)中位数的估计值的左边和右边的小矩形的面积和是相等的.2.平均数、方差的公式推广(1)若数据x1,x2,⋯,xn的平均数为 x,则mx1+a,mx2+a,mx3+a,⋯,mxn+a的平均数是mx+a.(2)若数据x1,x2,⋯,xn的方差为s2,则数据ax1+b,ax2+b,⋯,axn+b的方差为 a2s2.考点一

茎叶图[典例]

(2017

山·东高考

)如图所示的茎叶图记录了甲、乙两组各

5名工人某日的产量数据

(单位:件

).若这两组数据的中位数相等,且平均值也相等,则

x和

y的值分别为

(

)A.3,5

B.5,5C.3,7

D.5,7[解析]

由两组数据的中位数相等可得

65=60+y,解得

y=5,又它们的平均值相等,所以15×[56+62+65+74+(70+x)]=15×(59+61+67+65+78),解得x=3.[答案] A[解题技法] 茎叶图的应用茎叶图通常用来记录两位数的数据,可以用来分析单组数据,也可以用来比较两组数据.通过茎叶图可以确定数据的中位数,数据大致集中在哪个茎,数据是否关于该茎对称,数据分布是否均匀等.给定两组数据的茎叶图,比较数字特征时,“重心”下移者平均数较大,数据集中者方差较小.[题组训练]1.在如图所示一组数据的茎叶图中,有一个数字被污染后模糊不清,但曾计算得该组数据的极差与中位数之和为 61,则被污染的数字为 ( )A.1B.2C.3D.4解析:选B由图可知该组数据的极差为48-20=28,则该组数据的中位数为61-28=33,易得被污染的数字为 2.2.甲、乙两名篮球运动员 5场比赛得分的原始记录如茎叶图所示,若甲、乙两人的平均得分分别为 x甲,x乙,则下列结论正确的是 ( )x甲<x乙;乙比甲得分稳定x甲>x乙;甲比乙得分稳定x甲>x乙;乙比甲得分稳定x甲<x乙;甲比乙得分稳定解析:选A因为x甲=2+7+8+16+22=11,x乙=8+12+18+21+25=16.8,所55以x甲<x乙且乙比甲成绩稳定.考点二 频率分布直方图[典例] 某城市 100户居民的月平均用电量 (单位:千瓦时 ),以[160,180),[180,200),[200,220),[220,240),[240,260),[260,280),[280,300]分组的频率分布直方图如图.(1)求直方图中 x的值;(2)求月平均用电量的众数和中位数.[解] (1)由(0.002+0.0095+0.011+0.0125+x+0.005+0.0025)×20=1,解得x=0.0075.即直方图中 x的值为0.0075.(2)月平均用电量的众数是 220+240=230.2(0.002+0.0095+0.011)×20=0.45<0.5,(0.002+0.0095+0.011+0.0125)×20=0.7>0.5,∴月平均用电量的中位数在 [220,240)内.设中位数为

a,则

0.45+0.0125×(a-220)=0.5,解得

a=224,即中位数为

224.[

变透练清

]1.某校随机抽取5为组距将数据分组为

20个班,调查各班有出国意向的人数, 所得数据的茎叶图如图所示.[0,5),[5,10),⋯,[30,35),[35,40],所作的频率分布直方图是 (

以)解析:选A 以5为组距将数据分组为 [0,5),[5,10),⋯,[30,35),[35,40],各组的频数依次为 1,1,4,2,4,3,3,2,可知画出的频率分布直方图为选项 A中的图.2.变结论 在本例条件下,在月平均电量为 [220,240),[240,260),[260,280),[280,300]的四组用户中,用分层抽样的方法抽取 11户居民,则月平均用电量在 [220,240)的用户中应抽取________户.解析:月平均用电量在电量在[240,260)的用户有

[220,240)的用户有0.0125×20×100=25(户).同理可得月平均用15户,月平均用电量在 [260,280]的用户有10户,月平均用电量在[280,300]的用户有

5户,故抽取比例为

11 =1.25+15+10+5 5所以月平均用电量在

[220,240)的用户中应抽取

25×1=5(户).5答案:53.我国是世界上严重缺水的国家,某市为了制定合理的节水方案,对居民用水情况进行了调查,通过抽样,获得了某年100位居民每人的月均用水量(单位:吨),将数据按照[0,0.5),[0.5,1),⋯,[4,4.5]分成9组,制成了如图所示的频率分布直方图.(1)求直方图中

a的值;(2)设该市有

30万居民,估计全市居民中月均用水量不低于

3吨的人数,说明理由.解:(1)由频率分布直方图可知,月均用水量在

[0,0.5)的频率为

0.08×0.5=0.04.同理,在[0.5,1),[1.5,2),[2,2.5),[3,3.5),[3.5,4),[4,4.5]6

组的频率分别为

0.08,0.21,0.25,0.06,0.04,0.02.由1-(0.04+0.08+0.21+0.25+0.06+0.04+0.02)=0.5×a+0.5×a,解得a=0.30.(2)估计全市居民中月均用水量不低于

3吨的人数为

3.6万.理由如下:由(1)知,100位居民中月均用水量不低于

3吨的频率为

0.06+0.04+0.02=0.12.由以上样本的频率分布,可以估计

30万居民中月均用水量不低于

3吨的人数为

300000×0.12=36000=3.6(万).考点三

样本的数字特征考法(一)

样本的数字特征与频率分布直方图交汇[典例]

(2019

·宁师范大学附属中学模拟辽

)某校初三年级有

400名学生,随机抽查了

40名学生测试 1分钟仰卧起坐的成绩 (单位:次

),将数据整理后绘制成如图所示的频率分布直方图.用样本估计总体,下列结论正确的是

(

)A.该校初三学生1分钟仰卧起坐的次数的中位数为25B.该校初三学生1分钟仰卧起坐的次数的众数为24C.该校初三学生1分钟仰卧起坐的次数超过30的人数约有80D.该校初三学生1分钟仰卧起坐的次数少于20的人数约为8[解析]第一组数据的频率为0.02×5=0.1,第二组数据的频率为0.06×5=0.3,第三组数据的频率为0.08×5=0.4,∴中位数在第三组内,设中位数为25+x,则x×0.08=0.5-0.1-0.3=0.1,∴x=1.25,∴中位数为

26.25,故

A错误;第三组数据所在的矩形最高,第三组数据的中间值为

27.5,∴众数为

27.5,故

B错误;1分钟仰卧起坐的次数超过

30的频率为

0.2,∴超过

30次的人数为

400×0.2=80,故

C正确;1

分钟仰卧起坐的次数少于20的频率为

0.1,∴1分钟仰卧起坐的次数少于

20的人数为

400×0.1=40,故

D错误.故选

C.[答案]

C[解题技法]频率分布直方图与众数、中位数、平均数的关系(1)最高的小长方形底边中点的横坐标为众数;(2)中位数左边和右边的小长方形的面积和是相等的;平均数是频率分布直方图的“重心”,等于频率分布直方图中每个小长方形的面积乘以小长方形底边中点的横坐标之和.考法(二)

样本的数字特征与茎叶图交汇分为

[典例]将某选手的9个得分去掉1个最高分,去掉1个最低分,7个剩余分数的平均91.现场作的9个分数的茎叶图后来有1个数据模糊,无法辨认,在图中以x表示,则7个剩余分数的方差为

________.[解析]由茎叶图可知去掉的两个数是87,99,所以87+90×2+91×2+94+90+x=21222-91)2×2]=36.91×7,解得x=4.故s=[(87-91)+(90-91)×2+(91-91)×2+(9477[答案]367[解题技法]样本的数字特征与茎叶图综合问题的注意点在使用茎叶图时,一定要观察所有的样本数据,弄清楚这个图中数字的特点,不要漏掉了数据,也不要混淆茎叶图中茎与叶的含义.(2)茎叶图既可以表示两组数据, 也可以表示一组数据, 用它表示的数据是完整的数据,因此可以从茎叶图中看出数据的众数 (数据中出现次数最多的数 )、中位数(中间位置的一个数,或中间两个数的平均数 )等.考法(三) 样本的数字特征与优化决策问题交汇[典例] (2018·口调研周)甲、乙两人在相同条件下各射击 10次,每次中靶环数情况如图所示.(1)请填写下表(写出计算过程 ):平均数 方差 命中9环及9环以上的次数甲乙(2)从下列三个不同的角度对这次测试结果进行分析:①从平均数和方差相结合看 (分析谁的成绩更稳定 );②从平均数和命中 9环及9环以上的次数相结合看 (分析谁的成绩好些 );③从折线图上两人射击命中环数的走势看 (分析谁更有潜力 ).[解] 由题图,知甲射击10次中靶环数分别为 9,5,7,8,7,6,8,6,7,7.将它们由小到大排列为 5,6,6,7,7,7,7,8,8,9.乙射击10次中靶环数分别为 2,4,6,8,7,7,8,9,9,10.将它们由小到大排列为 2,4,6,7,7,8,8,9,9,10.(1)x甲=101×(5+6×2+7×4+8×2+9)=7(环),x乙=101×(2+4+6+7×2+8×2+9×2+10)=7(环),21222221s甲=10×[(5-7)+(6-7)×2+(7-7)×4+(8-7)×2+(9-7)]=10×(4+2+0+2+4)=1.2,212222222]s乙=10×[(2-7)+(4-7)+(6-7)+(7-7)×2+(8-7)×2+(9-7)×2+(10-7)101×(25+9+1+0+2+8+9)=5.4.填表如下:平均数方差命中9环及9环以上的次数甲71.21乙75.432 2(2)①∵平均数相同, s甲<s乙,∴甲成绩比乙稳定.②∵平均数相同,命中 9环及9环以上的次数甲比乙少,∴乙成绩比甲好些.③∵甲成绩在平均数上下波动,而乙处于上升势头,从第三次以后就没有比甲少的情况发生,∴乙更有潜力.[解题技法]利用样本的数字特征解决优化决策问题的依据平均数反映了数据取值的平均水平;标准差、方差描述了一组数据围绕平均数波动的大小.标准差、方差越大,数据的离散程度越大,越不稳定;标准差、方差越小,数据的离散程度越小,越稳定.(2)用样本估计总体就是利用样本的数字特征来描述总体的数字特征.[题组训练]1.对某商店一个月内每天的顾客人数进行统计,得到样本的茎叶图 (如图所示),则该样本中的中位数、众数、极差分别是 ( )A.46,45,56B.46,45,53C.47,45,56D.45,47,53解析:选A样本共30个,中位数为45+47=46;显然样本数据出现次数最多的为45,2故众数为45;极差为68-12=56,故选A.2.甲、乙、丙、丁四人参加某运动会射击项目选拔赛,四人的平均成绩和方差如下表所示:甲乙丙丁平均环数x8.38.88.88.7方差s23.53.62.25.4从这四个人中选择一人参加该运动会射击项目比赛,最佳人选是 ( )A.甲

B.乙C.丙

D.丁解析:选

C

由表格中数据可知,乙、丙平均环数最高,但丙方差最小,说明成绩好,且技术稳定,选

C.3.某仪器厂从新生产的一批零件中随机抽取

40个进行检测,如图是根据抽样检测得到的零件的质量

(单位:克

)绘制的频率分布直方图,样本数据按照

[80,82),[82,84),[84,86),[86,88),[88,90),[90,92),[92,94),[94,96]分成8组,将其按从左到右的顺序分别记为第一组,第二组,⋯⋯,第八组.则样本数据的中位数在第 ________组.解析:由题图可得,前四组的频率为 (0.0375+0.0625+0.0750+0.1000)×2=0.55,则其频数为 40×0.55=22,且第四组的频数为 40×0.1000×2=8,故中位数在第四组.答案:四[课时跟踪检测 ]A级1.一个频数分布表 (样本容量为 30)不小心被损坏了一部分, 只记得样本中数据在 [20,60)上的频率为 0.8,则估计样本在 [40,60)内的数据个数为 ( )A.14

B.15C.16

D.17解析:选B 由题意,样本中数据在 [20,60)上的频数为 30×0.8=24,所以估计样本在 [40,60)内的数据个数为 24-4-5=15.2.(2019长·春质检)如图所示是某学校某年级的三个班在一学期内的六次数学测试的平均成绩y关于测试序号 x的函数图象,为了容易看出一个班级的成绩变化, 将离散的点用虚线连接,根据图象,给出下列结论:①一班成绩始终高于年级平均水平,整体成绩比较好;②二班成绩不够稳定,波动程度较大;③三班成绩虽然多数时间低于年级平均水平,但在稳步提升.其中正确结论的个数为 ( )A.0B.1C.2D.3解析:选D①由图可知一班每次考试的平均成绩都在年级平均成绩之上,故①正确. ②由图可知二班平均成绩的图象高低变化明显,可知成绩不稳定,波动程度较大,故②正确.③由图可知三班平均成绩的图象呈上升趋势,

并且图象的大部分都在年级平均成绩图象的下方,故③正确.故选

D.3.(2018

·阳检测贵

)在某中学举行的环保知识竞赛中,将三个年级参赛学生的成绩进行整理后分为 5组,绘制如图所示的频率分布直方图, 图中从左到右依次为第一、 第二、第三、第四、第五小组,已知第二小组的频数是 40,则成绩在 80~100分的学生人数是 ( )A.15B.18C.20D.25解析:选A根据频率分布直方图,得第二小组的频率是0.04×10=0.4,∵频数是40,∴样本容量是

40=100,又成绩在

80~100

分的频率是

(0.01+0.005)×10=0.15,∴成绩在0.480~100分的学生人数是

100×0.15=15.故选

A.4.2017年

4月,泉州有四处湿地被列入福建省首批重要湿地名录,

某同学决定从其中

A,B

两地选择一处进行实地考察.因此,他通过网站了解上周去过这两个地方的人对它们的综合评分, 并将评分数据记录为右图的茎叶图,记 A,B两地综合评分数据的均值分别为 xA,xB,方差分别为s2A,s2B.若以备受好评为依据,则下述判断较合理的是 ( )A.因为 xA>xB,s2A>s2B,所以应该去 A地B.因为 xA>xB,s2A<s2B,所以应该去 A地C.因为 xA<xB,s2A>s2B,所以应该去 B地D.因为 xA<xB,s2A<s2B,所以应该去 B地解析:选B 因为xA=16×(72+86+87+89+92+94)≈86.67,xB=16×(74+73+8886+95+94)=85,212+(86-86.67)22+(89-86.67)2+(92-86.67)2+(94-sA≈6[(72-86.67)+(87-86.67)86.67)2]≈50.56,21222+(86-222,sB=[(74-85)+(73-85)+(88-85)85)+(95-85)+(94-85)]=766所以xA>xB,sA2<sB2(A数据集中,B数据分散),所以A地好评分高,且评价稳定.故选B.5.(2018青·岛三中期中)已知数据x1,x2,⋯,xn的平均数x=5,方差s2=4,则数据3x1+7,3x2+7,⋯,3xn+7的平均数和标准差分别为()A.15,36B.22,6C.15,6D.22,36解析:选B∵x1,x2,x3,⋯,xn的平均数为5,x1+x2+⋯+xn=5,∴3x1+3x2+⋯+3xn+7=3x1+x2+⋯+xn+7=3×5+7=22.nnn∵x1,x2,x3,⋯,xn的方差为4,∴3x1+7,3x2+7,3x3+7,⋯,3xn+7的方差是32×4=36,故数据3x1+7,3x2+7,⋯,3xn+7的平均数和标准差分别为22,6,故选B.6.(2018江·苏高考)已知5位裁判给某运动员打出的分数的茎叶图如图所示,那么这5位裁判打出的分数的平均数为________.解析:这5位裁判打出的分数分别是89,89,90,91,91,因此这5位裁判打出的分数的平均数为89+89+90+91+91=90.5答案:907.为了了解某校高三美术生的身体状况,抽查了部分美术生的体重,将所得数据整理后,作出了如图所示的频率分布直方图.已知图中从左到右的前3个小组的频率之比为3∶5,第2个小组的频数为15,则被抽查的美术生的人数是________.

1∶解析:设被抽查的美术生的人数为n,因为后2个小组的频率之和为(0.0375+0.0125)×5=0.25,所以前3个小组的频率之和为0.75.又前3个小组的频率之比为1∶3∶5,第2个小组的频数为15,所以前3个小组的频数分别为5,15,25,所以n=5+15+25=60.0.75答案:608.某人5次上班途中所花的时间(单位:分钟)分别为x,y,10,11,9.已知这组数据的平均数为10,方差为2,则|x-y|的值为________.解析:由题意知这组数据的平均数为10,方差为2,可得x+y=20,(x-10)2+(y-10)2=8,设x=10+t,y=10-t,由(x-10)2+(y-10)2=8得t2=4,所以|x-y|=2|t|=4.答案:49.某班100名学生期中考试语文成绩的频率分布直方图如图所示,其中成绩分组区间是[50,60),[60,70),[70,80),[80,90),[90,100].(1)求图中a的值;(2)根据频率分布直方图,估计这100名学生语文成绩的平均分;(3)若这100名学生语文成绩某些分数段的人数(x)与数学成绩相应分数段的人数(y)之比如表所示,求数学成绩在[50,90)之外的人数.分数段[50,60)[60,70)[70,80)[80,90)x∶y1∶12∶13∶44∶5解:(1)由频率分布直方图知 (0.04+0.03+0.02+2a)×10=1,因此a=0.005.(2)因为55×0.05+65×0.4+75×0.3+85×0.2+95×0.05=73.所以这100名学生语文成绩的平均分为 73分.(3)分别求出语文成绩在分数段 [50,60),[60,70),[70,80),[80,90)的人数依次为 0.05×1005,0.4×100=40,0.3×100=30,0.2×100=20.所以数学成绩分数段在 [50,60),[60,70),[70,80),[80,90)的人数依次为 5,20,40,25.所以数学成绩在 [50,90)之外的人数有 100-(5+20+40+25)=10.B级1.某车间将 10名技工平均分成甲、 乙两组加工某种零件, 在单位时间内每个技工加工的合格零件数的统

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论