




免费预览已结束,剩余77页可下载查看
下载本文档
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
第3章数据整理与显示,3.1数据的整理3.2数据的显示3.3Excel的应用,学习目标,了解数据预处理的内容和目的掌握分类和顺序数据的整理与显示方法掌握数值型数据的整理与显示方法会用Excel制作各种统计图和统计表合理使用统计表,3.1数据的整理,数据整理的步骤数据筛选与排序数据整理过程,数据整理的步骤,设计数据整理方案对统计资料进行审核、筛选与排序分组或分类、计算和汇总编制统计表、绘制统计图,数据筛选与排序,数据筛选(datafilter),当数据中的错误不能予以纠正,或者有些数据不符合调查的要求而又无法弥补时,需要对数据进行筛选数据筛选的内容将某些不符合要求的数据或有明显错误的数据予以剔除将符合某种特定条件的数据筛选出来,而不符合特定条件的数据予以剔除,用Excel进行数据筛选,8名学生的考试成绩数据,数据筛选(datafilter),步骤(自动筛选1),步骤(自动筛选2),步骤(自动筛选3),结果:筛选出的统计学成绩为75分的数据,步骤(自动筛选4),在前10个数据中筛选出英语成绩为前三名的,步骤(高级筛选1),筛选出4门课程成绩都大于70分的学生,步骤(高级筛选2),步骤(高级筛选3),数据排序(datarank),按一定顺序将数据排列,以发现一些明显的特征或趋势,找到解决问题的线索排序有助于对数据检查纠错,以及为重新归类或分组等提供依据在某些场合,排序本身就是分析的目的之一排序可借助于计算机完成,数据排序(方法),分类数据的排序字母型数据,排序有升序降序之分,但习惯上用升序汉字型数据,可按汉字的首位拼音字母排列,也可按笔画排序,其中也有笔画多少的升序降序之分数值型数据的排序递增排序:设一组数据为x1,x2,xn,递增排序后可表示为:x(1)x(2)x(n),例子,例子,例子,按行排序,数据整理过程,数据的整理(基本问题),要弄清所面对的数据类型,因为不同类型的数据,所采取的处理方式和方法是不同的对分类数据和顺序数据主要是作分类整理对数值型数据则主要是作分组整理适合于低层次数据的整理和显示方法也适合于高层次的数据;但适合于高层次数据的整理和显示方法并不适合于低层次的数据,分类数据的整理与图示,分类数据的整理(基本过程),1.列出各类别,3.制作频数分布表4.用图形显示数据,分类数据的整理(可计算的统计量),频数(frequency):落在各类别中的数据个数比例(proportion):某一类别数据占全部数据的比值百分比(percentage):将对比的基数作为100而计算的比值比率(ratio):不同类别数值的比值,分类数据频数分布表,顺序数据的整理与图示,顺序数据的整理(可计算的统计量),1.累积频数(cumulativefrequencies):各类别频数的逐级累加2.累积频率(cumulativepercentages):各类别频率(百分比)的逐级累加,顺序数据的频数分布表(例题分析),【例】在一项城市住房问题的研究中,研究人员在甲乙两个城市各抽样调查300户,其中的一个问题是:“您对您家庭目前的住房状况是否满意?1非常不满意;2不满意;3一般;4满意;5非常满意。,顺序数据的频数分布表(例题分析),数据分组,数据分组的作用,区分事物的性质例:将我国企业进行分组,就可以有效地区分它们在所有制方面的区别研究统计总体的类型和结构例企业根据职工文化程度不同分组,以便根据不同文化层次分期分批培训反映现象之间的依存关系,可以看出流通费用率与流转额之间存在着比较密切的相关关系,分组方法,分组方法,单变量值分组(要点),1.将一个变量值作为一组2.适合于离散变量3.适合于变量值较少的情况,例子,单变量值数据排序,单变量值分组频数分布表,组距分组(要点),将变量值的一个区间作为一组适合于连续变量适合于变量值较多的情况需要遵循“不重不漏”的原则可采用等距分组,也可采用不等距分组,组距分组(步骤),确定组数:组数的确定应以能够显示数据的分布特征和规律为目的。在实际分组时,可以按Sturges提出的经验公式来确定组数K,确定组距:组距(ClassWidth)是一个组的上限与下限之差,可根据全部数据的最大值和最小值及所分的组数来确定,即组距(最大值-最小值)组数,统计出各组的频数并整理成频数分布表,组距分组(几个概念),1.下限(lowlimit):一个组的最小值2.上限(upperlimit):一个组的最大值3.组距(classwidth):上限与下限之差4.组中值(classmidpoint):下限与上限之间的中点值,频数分布表的编制(例题分析),【例】某生产车间50名工人日加工零件数(单位:个)。试对数据进行分组。,频数分布表的编制(步骤),确定组数:根据Sturges提出的经验公式得组数K为:,确定各组的组距:组距(139-107)74.65,3.用Excel制作频数分布表,等距分组表(上下组限重叠),等距分组表(上下组限间断),组距分组与不等距分组(在表现频数分布上的差异),等距分组各组频数的分布不受组距大小的影响可直接根据绝对频数来观察频数分布的特征不等距分组各组频数的分布受组距大小不同的影响各组绝对频数的多少不能反映频数分布的实际状况需要用频数密度(频数密度=频数/组距)反映频数分布的实际状况,频数分布的类型,钟型分布(Bell-shapeddistribution),特征是“两头小、中间大”,其分布曲线宛如一口古钟图(a)被称为正态分布图(b)和(c)被称为偏态分布,其中,图(b)为正偏态分布图(c)为负偏态分布许多社会经济和自然现象总体的频数分布都趋向于正态分布,(a)(b)(c),U型分布(U-shapeddistribution),U型分布的形状跟钟型分布相反,靠近中间的变量值频数少,靠近两端的变量值频数多,形成“两头大、中间小”的U字型例如,人口死亡率分布就是这种分布;人口总体中,幼儿和老年人死亡率高,而中青年死亡率低,J型分布(J-shapeddistribution),J型分布有两种类型,一种是正J型分布,即频数随着变量值的增大而增多,如图3.1.15(a)所示;另一种是反J型分布,如图3.1.15(b)所示。例如,经济学中供给曲线随着价格的提高,供给量以更快速度增加,呈现出正J型;而需求曲线则表现为随着价格的提高,需求量以较快的速度减少,呈现为反J型,(a)(b),数据显示,统计表的结构,行标题,数字资料,附加,表头,列标题,合理安排统计表的结构数据计量单位相同时,可放在表的右上角标明,不同时应放在每个指标后或单列出一列标明表中的上下两条横线一般用粗线,其他线用细线通常情况下,统计表的左右两边不封口表中的数据一般是右对齐,有小数点时应以小数点对齐,而且小数点的位数应统一对于没有数字的表格单元,一般用“”表示必要时可在表的下方加上注释,统计表的设计,统计表的设计(比较与选用),统计表的设计(比较与选用),统计表的设计(比较与选用),分类数据的图示条形图(barChart),用宽度相同的条形的高度或长短来表示各类别数据的图形有单式条形图、复式条形图等形式主要用于反映分类数据的频数分布绘制时,各类别可以放在纵轴,称为条形图,也可以放在横轴,称为柱形图,分类数据的图示条形图(例题分析),图3.2.1类别数据条形图,图3.2.2离散型变量次数分布条形图,分组数据直方图(histogram),用矩形的宽度和高度来表示频数分布的图形,实际上是用矩形的面积来表示各组的频数分布在直角坐标中,用横轴表示数据分组,纵轴表示频数或频率,各组与相应的频数就形成了一个矩形,即直方图直方图下的总面积等于1,分组数据的图示(直方图的绘制),某生产车间50名工人日加工零件频数分布直方图,我一眼就看出来了,加工零件在120125之间的人数最多!,分组数据直方图(直方图与条形图的区别),条形图是用条形的长度(横置时)表示各类别频数的多少,其宽度(表示类别)则是固定的直方图是用面积表示各组频数的多少,矩形的高度表示每一组的频数或百分比,宽度则表示各组的组距,其高度与宽度均有意义直方图的各矩形通常是连续排列,条形图则是分开排列条形图主要用于展示分类数据,直方图则主要用于展示数值型数据,分组数据折线图(frequencypolygon),折线图也称频数多边形图是在直方图的基础上,把直方图顶部的中点(组中值)用直线连接起来,再把原来的直方图抹掉折线图的两个终点要与横轴相交,具体的做法是第一个矩形的顶部中点通过竖边中点(即该组频数一半的位置)连接到横轴,最后一个矩形顶部中点与其竖边中点连接到横轴折线图下所围成的面积与直方图的面积相等,二者所表示的频数分布是一致的,分组数据的图示(折线图的绘制),折线图与直方图下的面积相等!,某生产车间50名工人日加工零件频数分布直方图,分类数据的图示饼图(pieChart),也称圆形图,是用圆形及圆内扇形的面积来表示数值大小的图形主要用于表示总体或样本中各组成部分所占的比例,对于研究结构性问题十分有用绘制圆形图时,总体中各部分所占的百分比用圆内的各个扇形面积表示,这些扇形的中心角度,是按各部分数据百分比占3600的相应比例确定的,分类数据的图示饼图(例题分析),环形图(annularchart),环形图中间有一个“空洞”,总体中的每一部分数据用环中的一段表示环形图与圆形图类似,但又有区别圆形图只能显示一个总体各部分所占的比例环形图则可以同时绘制多个总体的数据系列,每一个总体的数据系列为一个环环形图可用于结构比较研究环形图主要用于展示分类和顺序数据,环形图(例题分析),线图,乙城市累积频数分布图,散点图,数据类型及图示(小结),Excel应用,建立统计表,输入数据。首先进入Excel,选定准备向其中输入数据的单元格,然后将文字、数字、时间、日期或公式输入到单元格中,然后单击编辑栏中的“”或按Enter键、Tab键以及方向键予以确认简单计算。在整理资料时若需要计算,可先在单元格中输入公式以便进行计算。公式可由数值、单元格、函数及运算符组成。输入公式的标志是在选定的单元格内先输入一个“=”,然后输入公式的具体内容。,绘制统计图,利用图表指南工具制作图表。单击“图表指南”工具,选择“建立新图表”在该对话框中选择所要创建的图表类型,再选择图表格式,并通过对话框提供的各个选项设定图例、图表标题、轴标题等细节。最终确定后单击“完成”按钮利用图表工具栏制图。具体做法是:在“视图”菜单中选择“工具”项,从中选择“图表”,出现图表工具栏。此时,先在工作表中选择区域,然后根据具体需要在图表工具栏中选择“图表类型”,数据处理,进行分类汇总和合并计算等复杂的数据处理工作实现资料内容的增加、修改、删除与查找对数据进行排序可以为各类数据的一些数据项进行统计汇总,例如,求和利用“合并计算”可以将一个或多个工作簿中若干张结构相同的表进行表间的汇总,建立数据透视表,某单位部分人事统计表,画K线图(举例说明),操作步骤:1、点击图表向导,选择股价图以及子股价图:成交量开盘盘高盘低收盘图,如图3.4.14所示。2、点击下一步,进入图表向导步骤2,输入数据区域。3、点击下一步,进入图表向导步骤3图表选项。点击标题,在图表标题栏内输入“K线图”,在数值(Y)轴栏内输入“成交量”,在次数值(Y)轴栏内输入“股价”;点击坐标轴,将主坐标轴的分类(X)轴选为分类;点击图例,去掉显示图例,点击完成。4、修饰草图。双击主数值轴,在坐标轴格式对话框中,单击刻度,将最大值设置为“20000000”,并把显示单位选择成“百万”,点击完成;双击次主数值轴,在坐标轴格式对话框中,单击数字,将小数位数设置为“0”,点击完成;双击分类轴,在坐标轴格式对话框中,单击字体,将字号设置为“8”,点击完成。,5、添加移动平
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 校本培训经验课件
- 校外培训机构安全知识培训课件
- 导数考试题型及答案
- 盐业局的考试试题及答案
- 北京音乐知识培训课件
- 医药耗材面试题及答案
- 技师磨工考试题及答案
- 品牌饮品测试题及答案
- 主管护师考试试题及答案
- 客船培训考试题及答案
- 2025-2030中国骨形态发生蛋白行业市场现状供需分析及投资评估规划分析研究报告
- 《钓鱼的艺术教学》课件
- T-CACM 1064-2018 针刀医学临床 通.用要求
- 天津市南开区2025年数学五年级第二学期期末综合测试试题含答案
- 电气行业与市场分析
- 2025年3月医务工作者个人自传范文
- 2025年乡村全科助理医师考试题库及答案
- 排水设施养护管理制度
- 钢管柱混凝土施工方案
- 2025小学《义务教育语文课程标准》(2022 年版)测试题库及答案【共3 套】
- 小学植物百科知识
评论
0/150
提交评论