统计数据计量和整理.ppt_第1页
统计数据计量和整理.ppt_第2页
统计数据计量和整理.ppt_第3页
统计数据计量和整理.ppt_第4页
统计数据计量和整理.ppt_第5页
免费预览已结束,剩余59页可下载查看

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

统计数据的计量与整理,数据的计量与类型统计数据的整理与显示,补充材料之一:,数据的计量尺度,在计量学的一般分类方法中,依据对事物计量的精确程度,可将所采用的计量尺度由低级到高级、由粗略到精确分为四个层次:定类数据、定序数据、定距数据和定比数据就上述四种计量尺度计量的结果来看,可以大体上将统计数据分为两种类型:定性的数据和定量的数据。定性数据(Qualitativedata,亦称品质数据)是说明事物的品质特征表现的具体类别,不能用数值表示;定量数据(Quantitativedata,亦称数量数据或数值型数据)是说明现象数量特征表现的,能够甚至必须用数值来表现,四种计量尺度,数据的计量尺度,定类尺度,计量层次最低对事物进行平行的分类各类别可以指定数字代码表示使用时必须符合类别穷尽和互斥的要求数据表现为“类别”具有=或的数学特性如:按照性别将人口分为男、女两类;按照经济性质将企业分为国有、集体、私营、混合制企业等。,定序尺度,对事物分类的同时给出各类别的顺序比定类尺度精确未测量出类别之间的准确差值数据表现为“类别”,但有序具有或的数学特性如学历:文盲、小学、初中、高中、大学、研究生如可将人们的态度分为非常同意、同意、保持中立、不同意、非常不同意顺序尺度对事物的计量要比定类尺度精确些,但它至多测度了类别之间的顺序,而未测量出类别之间的准确差值,定距尺度,对事物的准确测度比定序尺度精确数据表现为“数值”具有+或-的数学特性通常使用自然或物理单位作为度量单位,如收入用人民币“元”度量,考试成绩用“百分制”度量,温度用摄氏或华氏的“度”区间尺度的计量结果表现为数值区间尺度的数值可做加、减法运算,例如,考试成绩80分与90分之间相差10分。但不能做乘、除法运算。,定比尺度,对事物的准确测度与定距尺度处于同一层次数据表现为“数值”具有或的数学特性如:30岁的人比10岁的人长3倍,四种计量尺度的比较,数据类型与统计方法,变量及其类型,统计指标及其类型,定类数据的整理与显示定序数据的整理与显示,定性数据的整理与显示,定类数据的整理与显示,定类数据的整理与显示(基本问题),要弄清所面对的数据类型,因为不同类型的数据,所采取的处理方式和方法是不同的对定类数据和定序数据主要是做分类整理对定距数据和定比数据则主要是做分组整理适合于低层次数据的整理和显示方法也适合于高层次的数据;但适合于高层次数据的整理和显示方法并不适合于低层次的数据,定类数据的整理(基本过程),1、列出各类别2、计算各类别的频数3、制作频数分布表4、用图形显示数据,定类数据的整理(可计算的指标),频数:落在各类别中的数据个数。频率:某一类别数据的频数占总体单位个数的比重。百分比:将对比的基数作为100而计算的比值。,定类数据整理频数分布表(实例),【例3.6】为研究广告市场的状况,一家广告公司在某城市随机抽取200人就广告问题做了邮寄问卷调查,其中的一个问题是“您最关心下列哪一类广告?”1商品广告;2服务广告;3金融广告;4房地产广告;5招生招聘广告;6其他广告。,定类数据的图示条形图(条形图的制作),条形图是用宽度相同的条形的高度或长短来表示数据变动的图形。条形图有单式、复式等形式。在表示定类数据的分布时,是用条形图的高度来表示各类别数据的频数或频率。绘制时,各类别可以放在纵轴,称为条形图,也可以放在横轴,称为柱形图。,定类数据的图示条形图(由Excel绘制的条形图),定类数据的图示圆形图(圆形图的制作),也称饼图,是用圆形及园内扇形的面积来表示数值大小的图形。主要用于表示总体中各组成部分所占的比例,对于研究结构性问题十分有用。在绘制圆形图时,总体中各部分所占的百分比用圆内的各个扇形面积表示,这些扇形的中心角度,是按各部分百分比占3600的相应比例确定的。例如,关注服务广告的人数占总人数的百分比为25.5%,那么其扇形的中心角度就应为360025.5%91.80,其余类推。,定类数据的图示圆形图(由Excel绘制的圆形图),定序数据的整理与显示,定序数据的整理(可计算的指标),1.累计频数:将各类别的频数逐级累加2.累计频率:将各类别的频率(百分比)逐级累加注:小于(大于)某一变量值的总频次是多少?如:两学生分别在班上考了80分,谁更好?,定序数据频数分布表(实例),【例2.7】在一项城市住房问题的研究中,研究人员在甲乙两个城市各抽样调查300户,其中的一个问题是:“您对您家庭目前的住房状况是否满意?1非常不满意;2不满意;3一般;4满意;5非常满意。,定序数据图示累计频数分布图(由Excel绘制的累计频数分布图),图2-3甲城市家庭对住房状况评价的累积频数分布,定序数据的图示环形图(环形图的制作),环形图中间有一个“空洞”,总体中的每一部分数据用环中的一段表示环形图与圆形图类似,但又有区别圆形图只能显示一个总体各部分所占的比例环形图则可以同时绘制多个总体的数据系列,每一个总体的数据系列为一个环环形图可用于进行比较研究环形图可用于展示定类和定序的数据,品质数据的图示环形图(由Excel绘制的环形图),三数值型数据的整理与显示,数据的分组数值型数据的图示频数分布的类型,频数分布表的编制,编制频数分布表的步骤,编制频数分布表的步骤,频数分布表的编制(实例),117122124129139107117130122125108131125117122133126122118108110118123126133134127123118112112134127123119113120123127135137114120128124115139128124121,【例3.3】某生产车间50名工人日加工零件数如下(单位:个)。试采用单变量值对数据进行分组。,分组方法,分组方法,指:每个变量值为一组,如:收入500元与1000元是有区别的,但10000元与11000区别不大,因此低收入分的要细,高收入分的要粗,单变量值分组(要点),1.将一个变量值作为一组2.适合于离散变量3.适合于变量值较少的情况,单变量值分组表(实例),组距分组(要点),将变量值的一个区间作为一组适合于连续变量适合于变量值较多的情况必须遵循“不重不漏”的原则可采用等距分组,也可采用不等距分组,组距分组(步骤),确定组数:组数的确定应以能够显示数据的分布特征和规律为目的。在实际分组时,可以按Sturges提出的经验公式来确定组数K,确定各组的组距:组距(ClassWidth)是一个组的上限与下限之差,可根据全部数据的最大值和最小值及所分的组数来确定,即组距(最大值-最小值)组数,根据分组整理成频数分布表,组距分组(几个概念),1.下限:一个组的最小值2.上限:一个组的最大值3.组距:上限与下限之差4.组中值:下限与上限之间的中点值,等距分组表(上下组限重叠),等距分组表(上下组限间断),等距分组表(使用开口组),组距分组与不等距分组(在表现频数分布上的差异),等距分组各组频数的分布不受组距大小的影响可直接根据绝对频数来观察频数分布的特征和规律不等距分组各组频数的分布受组距大小不同的影响各组绝对频数的多少不能反映频数分布的实际状况需要用频数密度(频数密度频数/组距)反映频数分布的实际状况,数值型数据的图示(用Excel作图),分组数据直方图(直方图的制作),用矩形的宽度和高度来表示频数分布的图形,实际上是用矩形的面积来表示各组的频数分布在直角坐标中,用横轴表示数据分组,纵轴表示频数或频率,各组与相应的频数就形成了一个矩形,即直方图(Histogram)直方图下的总面积等于1,分组数据直方图(直方图的绘制),分组数据直方图(直方图与条形图的区别),条形图是用条形的长度(横置时)表示各类别频数的多少,其宽度(表示类别)则是固定的直方图是用面积表示各组频数的多少,矩形的高度表示每一组的频数或百分比,宽度则表示各组的组距,其高度与宽度均有意义直方图的各矩形通常是连续排列,条形图则是分开排列,分组数据折线图(折线图的制作),折线图也称频数多边形图(Frequencypolygon)是在直方图的基础上,把直方图顶部的中点(组中值)用直线连接起来,再把原来的直方图抹掉。折线图的两个终点要与横轴相交,具体的做法是第一个矩形的顶部中点通过竖边中点(即该组频数一半的位置)连接到横轴,最后一个矩形顶部中点与其竖边中点连接到横轴。折线图下所围成的面积与直方图的面积相等,二者所表示的频数分布是一致的。,15,12,9,6,3,105,110,115,120,125,130,135,140,日加工零件数(个),频数(人),分组数据折线图(折线图的绘制),图3-6某车间工人日加工零件数的折线图,未分组数据箱线图(箱线图的制作),用于显示未分组的原始数据或分组数据的分布箱线图由一组数据的5个特征值绘制而成,它由一个箱子和两条线段组成其绘制方法是:首先找出一组数据的5个特征值,即最大值、最小值、中位数Me和两个四分位数(下四分位数QL和上四分位数QU)连接两个四分(位)数画出箱子,再将两个极值点与箱子相连接,未分组数据单批数据箱线图(箱线图的构成),未分组数据单批数据箱线图(实例),分布的形状与箱线图,图3-11不同分布的箱线图,未分组数据多批数据箱线图(实例),【例3.4】从某大学经济管理专业二年级学生中随机抽取11人,对8门主要课程的考试成绩进行调查,所得结果如表3-8。试绘制各科考试成绩的批比较箱线图,并分析各科考试成绩的分布特征,未分组数据多批数据箱线图(由STATIATICA绘制的多批数据箱线图),图3-128门课程考试成绩的箱线图,图3-1311名学生8门课程考试成绩的箱线图,Min-Max,25%-75%,Medianvalue,45,55,65,75,85,95,105,学生1,学生2,学生3,学生4,学生5,学生6,学生7,学生8,学生9,学生10,学生11,未分组数据箱线图(由STATIATICA绘制的多批数据箱线图),时间序列数据线图(线图的制作),绘制线图时应注意以下几点时间一般绘在横轴,指标数据绘在纵轴图形的长宽比例要适当,其长宽比例大致为10:7一般情况下,纵轴数据下端应从“0”开始,以便于比较。数据与“0”之间的间距过大时,可以采取折断的符号将纵轴折断,时间序列数据线图(实例),【例3.5】已知19911998年我国城乡居民家庭的人均收入数据如表3-11。试绘制线图,¥,时间序列数据(由Excel绘制的线图),雷达图(RadarChart)是显示多个变量的常用图示方法在显示或对比各变量的数值总和时十分有用假定各变量的取值具有相同的正负号,总的绝对值与图形所围成的区域成正比可用于研究多个样本之间的相似程度,多变量数据雷达图(要点),数据类型及图示(小结),频数分布的类型,图3-17几种常见的频数分布,婚姻次数,人口

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论