3第三章 统计数据的整 理(课件)- 《统计学原理》同步教学(铁道版)_第1页
3第三章 统计数据的整 理(课件)- 《统计学原理》同步教学(铁道版)_第2页
3第三章 统计数据的整 理(课件)- 《统计学原理》同步教学(铁道版)_第3页
3第三章 统计数据的整 理(课件)- 《统计学原理》同步教学(铁道版)_第4页
3第三章 统计数据的整 理(课件)- 《统计学原理》同步教学(铁道版)_第5页
已阅读5页,还剩36页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

学习目的及重难点提示

本章学习目的

了解数据整理在统计活动中的地位、数据整理的内容、

数据审核与汇总的技术。

领会统计分组的概念、关键、统计分组体系及次数分

布的类型和特征。

明确统计数据的表现形式——统计表和统计图的基本

内容。

掌握统计分组、分配数列和统计图表的编绘制方法。

本章重难点提示

本章重点:统计分组、变量数列的编制、统计数据的

显示方法——统计表和统计图。

本章难点:统计分组、变量数列的编制、次数分布图

的绘制。

一、数据整理的概念和作用

(一)概念

对统计调查所搜集到的数据进行分类和汇总,使

其系统化、条理化、科学化,以得出反映事物总体综

合特征的资料的工作过程。

(二)作用

统计数据整理,是统计调查的继续,也是统计分

析的前提,承前启后,在整个统计工作中具有重要的

作用。

二、数据整理的程序

数据整理方案的设计

数据的审核与检查

数据的排序

数据分组

数据的显示——统计图表

数据的积累与保管

第二节数据分组

一、数据分组的概念

根据统计研究目的和客观现象的内在特点,

按照选定的某个或几个标志,将被研究的总体

数据分成若干部分的科学分类。

二、数据分组的作用

(1)区分现象的类型。

(2)反映总体的内部结构。

(3)揭示现象之间的依存关系。

(4)反映事物的数量特征和发展规律。

第二节数据分组

三、数据分组的关键**

选择分组标志和分组划分各组界限(针对数值

型变量)。

四、选择分组标志的原则**

1.根据研究任务和目的选择分组标志。

2.选择能反映事物本质特征或重要特征的标

志。

3.结合现象所处的历史条件和社会经济条件

选择分组标志。

五、统计分组的种类

(一)根据分组变量(标志)的性质不同

按品质变量分组

按数值变量分组

(二)根据采用的分组标志的个数多

简单分组:只按一个标志分组

复合分组:按两个或以上的标志分组

一、分配数列

(一)概念

将总体按分组标志分组后形成的总体单位在各

组的分布,又称次数分布数列或频数分布数列。

(二)分配数列的要素

组别

次数(频数):分布在各组的总体单位数。各组的

次数(频数)之和等于总体单位总数。

频率(比重):各组次数占总次数的比重。各组比

重之和等于100%(或1)。

分配数列实例

表3-1我国土地状况分组表

按海拔分组面积占总面积比重

(米)(万平方公里)(%)

500以下241.725.18

500~1000162.516.93

1000~2000239.924.99

2000~300067.67.04

3000以上248.325.86

合计960.0100.00

(三)分配数列的种类

1.按分组标志的性质不同

品质变量数列:按品质变量分组形成

数值变量数列:按数值变量分组形成

2.数值变量数列又可分为:

单项数列:每组只有一个变量值的变量数列

组距数列:每组变量值是一段区间的变量数列

连续变量数列:按连续变量分组形成的数列

离散变量数列:按离散变量分组形成的数列

品质变量分配数列实例

表3-2某高校在校生性别状况分组表

性别人数(人)比重(%)

男生450055.56

女生360044.44

合计8100100.00

数值变量分配数列实例

表3-3某市餐饮业按营业额分组

营业额(万元)餐饮企业个数(家)比重(%)

10万元以下135058.70

10-5065028.25

50-1001807.83

100-500853.70

500万元以上351.52

合计2300100.00

单项式变量数列实例

表3-4某市居民家庭按家庭人口数分组

家庭人口数(人)家庭数(千户)比重(%)

19.85.76

227.516.18

394.655.65

419.211.29

510.96.41

68.04.71

合计170.0100.00

组距式变量数列实例

表3-5某车间工人按月工资分组

月工资(元)工人数(人)比重(%)

500元以下168.00

500-6002814.00

600-7003417.00

700-8005628.00

800-9003819.00

900-1000189.00

1000元以上105.00

合计200100.00

(四)分配数列的编制

1.概念术语

(1)全距(R)=数列中最大变量值-最小变量值

(2)组限:每一组的最大变量值与最小变量值

上限:每一组的最大变量值

下限:每一组的最小变量值

(3)组距(d):每一组的最大变量值与最小变量值之差

组距=上限—下限

(4)组数:数列中的分组个数。

组数和组距的关系

定性关系:全距一定的情况下,组数和组距呈

反方向变动。

定量关系:

组数=全距/组距=R/d

组距=R/(1+3.322lgN)

式二为确定组距的经验公式,其中N代表组数。

(四)分配数列的编制

1.概念术语

(5)频数(次数)与频率(比重)

(6)品质数列与变量数列

(7)等距数列与异距数列

(8)次数密度:单位组距内分布的总体单位数。

公式:

次数密度=各组次数/各组组距

1.概念术语

开口组:缺上限或缺下限的组

(9)

闭口组:上下限齐全的组

(10)组中值及计算**

①闭口组

临近组组限重合时:组中值=(上限+下限)/2

临近组组限间断时:组中值=(下限+下组下限)/2

②开口组

缺上限时:组中值=下限+邻组组距/2

缺下限时:组中值=上限-邻组组距/2

(四)分配数列的编制

2.注意事项

(1)组距最好为5或10的倍数。

(2)最小组的下限略低于最小变量值,最大组的

上限略高于最大变量值。

(3)离散型变量分组,相邻组的组限可以间断,

也可以重叠;连续型变量分组,相邻组的组限必须重

叠。

(4)组限重叠时,临界点的总体单位按“上限不

在内”的原则归组。

(四)分配数列的编制

3.简单次数分布数列的编制步骤

数据排序并计算全距

确定变量数列的形式(单项式或组距式)

确定组数和组距

确定组限

计算各组次数和频率

绘制表格

简单次数分布数列的编制实例

[例3-1]数据资料

某车间40名工人日产零件如下:

657266579086836875

846659677079518154

788694647774769662

988571798465728975

简单次数分布数列的编制实例

编制步骤之一——数据排序并确定全距

将数据从低到高排列,形成如下变量序列:

51545759626465656666

67687071727274757576

76777878798183848484

85868688899093949698

计算全距=98-51=47

编制步骤之二——确定变量数列的形式

因变量值较多、变动幅度较大,适宜采用组

距式数列。

简单次数分布数列的编制实例

编制步骤之三——确定组数和组距

[分析]全距为47,分为5组,组距为10。

编制步骤之四——确定组限

[分析]离散型变量分组,相邻组的组限可以重叠,也

可间断,本例选择重叠。

编制步骤之五——计算各组的频数和频率

[分析]根据排序后的变量序列清点各数据区间的频数

并计算比重,也可利用Excel统计软件进行。

简单次数分布数列的编制实例

编制步骤之六——绘制表格

表3-6某车间工人日产零件分组表

日产零件数量(件)工人数(人)比重(%)

50-60410.00

60-70820.00

70-801332.50

80-901025.00

90-100512.50

合计40100.00

4.累计次数分布表(图)的编制

(1)累计次数和累计频率

反映总体单位分布特征的指标,用以说

明总体中在某一变量值水平上下总共包含的

总体单位次数和频率。

(2)累计次数和频率的计算方法

向上累计:是将各组的次数和频率,由变量

值低的组向高的组累计。说明各组上限以下

包含的总体单位数和比率。

向下累计:是将各组的次数和频率,由变量

值高的组向低的组累计。说明各组下限以上

包含的总体单位数和比率。

累计次数分布数列的编制实例

[例3-2]根据例3-1编制的累计次数分布表如下:

表3-7某车间工人日产零件累计分组表

日产零件工人数比重向上累计向下累计

数量(件)(人)(%)次数频数次数频数

50-60410.00410.0040100.00

60-70820.001230.003690.00

70-801332.502562.502870.00

80-901025.003587.501537.50

90-100512.5040100.00512.50

合计40100.00--------

二、次数分布

社会经济现象的分布主要有以下三种类型:

(一)钟形分布/丘形分布

1.含义:特点是“两头小,中间大”,即越靠近中间的变量值分

布次数愈多;愈远离变量值中点分布的次数愈少,形态如钟或

山丘。

正态分布:左右两侧对称分布

2.种类左偏分布:存在极小变量值时曲线向左偏的

偏态分布非对称分布

右偏分布:存在极大变量值时曲线向右偏的

非对称分布

正态分布左偏分布右偏分布

二、次数分布

(二)U形分布:是指较大和较小的变量值出现的次数多,而中间变

量值出现的次数少,特点是“两头大,中间小”。

(三)J形分布:J形分布的特征是“一边大,一边小”。即次数随着

变量值的变化大多数集中在某一端的分布。其曲线形如英文字母

的“J”字,具体有正J形分布和反J形分布两种类型。

U形分布正J形分布反J形分布

**思考题:以下现象的次数分布符合哪种分布的特征?

A人群中身高、体重的分布B学生考试成绩的分布

C按人口年龄分布的死亡率D餐饮企业销售额的分布

一、统计表

(一)统计表的概念

(二)统计表的结构

1.从形式上看:分为总标题、横行标题、纵栏标题

和统计数值。

2.从内容上看:分为主词和宾词。

(三)统计表的种类

简单表:主词未做任何分组。

简单分组表:主词按一个标志分组。

复合分组表:主词按两个或以上的标志分组。

(四)统计表的编制规则

二、统计图

(一)概念

条形图

(二)种类直方图和折线图

圆形图

统计表示例

某居民小区家庭按月收入简单分组表

统计图示例

条形图——用长短或高矮来显示数值的大小

家庭人均生活费收入次数分布图

1413

800-1000

12

101000-1200

10

81200-1400

871400-1600

6

户651600-1800

431800-2000

22000-2200

2

2200-2400

0

月收入

统计图示例

折线图——将直方图的各条形中点用线连接起来而得到。

户数

14

13

12

1010

88

7户数

户66

5

数43

22

0

8112

00260

-1000000

0-1-1月收入-2

00482

000000

统计图示例

圆形图/饼图:是以圆形的分割来表示总体的分组及结构。

(某居民小

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论