《市场调查与分析》课件-第8章 调查资料的处理_第1页
《市场调查与分析》课件-第8章 调查资料的处理_第2页
《市场调查与分析》课件-第8章 调查资料的处理_第3页
《市场调查与分析》课件-第8章 调查资料的处理_第4页
《市场调查与分析》课件-第8章 调查资料的处理_第5页
已阅读5页,还剩180页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

市场调查与预测经济管理类专业公共课程教材认识资料整理的含义认识资料审核编码方法认识资料整理分析的意义会进行资料审核分类第8章调查资料的处理

学习目标知识目标技能目标会资料图表化显示能对资料进行分析第8章调查资料的处理4导语

当调查活动告一段落之后,会收集到许多杂乱零散的资料,这些资料必须经过整理与分析后,才能由半成品变为成品,才能由数据资料变为真正意义上的数据成果,以便为研究人员提出调查结论做准备。第8章调查资料的处理4调查故事在我国,有许多被称作“网络水军”的人,即有偿在线发贴和评论(主要出于营销目的)的一群人。学术研究发现,这些人正在降低互联网信息的质量。对于商家而言,付费发贴是影响产品公众口碑的一种方式。如果一家公司雇佣了足够多的在线用户,那么它就可以创建热点话题以获得关注。进而,这些由一群付费发贴者发布的文章或评论就很有可能获得普通用户的关注,进而影响他们的决定……5调查故事6调查故事【思考】从图中发现了什么?引导案例某公司派出市场调查人员深入市场进行实地考察,目的是想了解当地工业用户对某类产品的采购方式。市场调查人员走访了几十家公司后,发现各家公司的采购方式与各自公司规模大小、经营产品的类别等密切相关。市场调查人员又根据了解到的情况估计,认为这些公司的采购方式很可能与各家公司本身的特点密切相关。于是又将有关这几十家公司的规模、经营的产品等方面资料再作详细分组。为了能够客观地验证各家公司的规模与它的采购方式二者之间可能存在的某种关系,于是,市场调查人员根据各家公司的营业额把这几十家公司分为下列五组:营业额每年100万以上;营业额每年50~100万元;营业额每年25~49.9万元;营业额每年10~24.9万元;营业额每年10万元。分组之后,市场调查人员只需要在这五类规模大小各异的公司中,根据各类公司特点相互比较即可说明问题,而不必逐家公司去进行相互比较了。8.1调查资料整理概述

8.1.1调查资料整理的含义

1.资料整理的概念市场调查资料整理是指按照一定程序与科学的方法,对所收集到的资料加以整理、分析及统计运算,把庞大、复杂、零散的资料集中简化,使资料变成易于理解和解释的形式,为揭示和描述市场现象的特征、问题和原因提供初步加工信息的过程。8.1调查资料整理概述数据确认是指对调查所收集到的原始数据或二手资料进行审核,查找问题、采取补救措施、确保数据质量。数据加工是指对调查问卷或调查表提供的原始数据进行分类和汇总,或者对二手数据进行再分类和调整。2.资料整理的内容数据确认数据加工数据列示数据列示是指对加工整理后的调查数据用统计表、统计图、数据库、数据报告等形式表现出来。8.1调查资料整理概述3.资料整理的意义

(1)资料整理是市场调查必要的环节。(2)资料整理提高了调查资料价值。(3)资料整理可以激发新信息的产生。(4)资料整理可以纠正调查工作偏差。8.1调查资料整理概述

8.1.2调查资料整理程序1.设计整理方案

市场调查资料整理方案一般包括整理的目的与要求、资料审核、整理的内容与方式、汇总办法、整理时间、人员安排、数据管理等方面的一些设计和规定。2.审核调查资料

审核调查资料主要是审核调查问卷或调查表的完备性、完整性和填答的准确性,以便发现问题进行纠正、补充或删除,防止有问题的问卷或调查表进入整理的流程。或者对二手资料的可靠性、准确性、时效性、可比性等进行评估、以决定其取舍。8.1.2调查资料整理程序调查资料整理的验收与审查检查所有问卷的完整性①资料是否完整清楚。②资料中主要的关键问题是否回答。③资料中是否存在明显的错误或疏漏。例如,有的问卷只有开头部分回答完全;整个问卷只有一个选项。有的问卷在截止日期之后收回;回收的问卷有缺页或多页的情况。此外,如果邮寄的答案是手写的,可能由于字迹潦草,一些问题的答案难以分辨。资料验收与审查的方法1.计算检查法:从计算方法是否正确、计算结果有无差错等角度进行检查,并加以适当纠正。这是在资料编辑中经常遇到的问题,尤其是对于缺失数据的处理。2.经验判断法:判断数据的真实、准确。例如,如果被调查者的年龄填写为140岁,根据经验判断,年龄填写肯定有误。3.逻辑性检查法:指根据调查项目之间的内在联系和实际情况,对数据资料进行逻辑判断,看是否有不合情理或前后矛盾的情况,并加以纠正。电话复查3.资料分组

原始资料和二手资料审核无误后,即可进行分组处理。分组是根据研究的需要,按一定的标志或标准将总体各单位区分为若干组(类)的一种数据加工处理方法。用以划分市场现象的不同类型,揭示总体的内部结构和分布特征,显示市场现象之间的依存关系。市场调查资料分类的标准有属性、数量、时间、空间、关联性等,利用这些分类标准可以对问卷或调查表数据进行多方向、多层次的加工开发和交叉开发。4.统计汇总

统计汇总是在分组处理的基础上,利用手工汇总或计算机汇总技术求出各种分组的各组单位数、总体单位数、各组指标、总体综合指标等。其中手工汇总技术主要有过录法、折叠法、卡片法、问卷分类汇总法,等等。计算机汇总一般包括编码、数据录入、缺省值处理等工作程序,它具有速度快,精度高和便于存储数据等特点,特别适合于大批量的数据处理。8.1.2调查资料整理程序

分组,使得同一组内的各单位在分组标志上具有同质性,不同组之间的单位具有差异性。调查资料整理的分组(一)市场调查资料的分组分组(分类)的步骤第一,选择恰当的分组标志第二,确定分组形式第三,确定组距和组数第四,确定组限与组中值(二)分组的类型1.品质标志分组和数量标志分组按照分组标志性质的不同,统计分组可分为:(1)品质标志分组选择反映事物属性差异的品质标志

(2)数量标志分组选择反映事物数量差异的数量标志数量标志分组的类型变量分组有以下两种基本方法:(1)单项式分组。(2)组距式分组。2.简单分组和复合分组按照分组标志个数多少的不同,统计分组可分为:(1)简单分组。(2)复合分组。

(1)按品质标志分组即选择反映事物属性差异的品质标志作为分组标志进行分组,当分组标志一旦确定,组名称和组数就确定,不存在组与组之间的界限区分的困难。

(2)按数量标志分组

即选择反映事物数量差异的数量标志作为分组标志进行分组,确定各组在数量上的差别。2、分组的形式(1)简单分组就是对研究对象只按一个标志进行的分组。

(2)复合分组

用两个或两个以上的标志按顺序连续进行的分组。这样有助于对对象的层层分析,研究对象标志较多的时候采用此方法。组距数列组距数列是总体按组距式分组而形成的变量数列。每个组是由若干个(一组)变量值形成的区间表示,在变量值个数较多、变动幅度较大时采用。例如,某工厂工人完成生产定额情况表

工人按完成生产定额分组(%)组中值工人数绝对数比重(%)90以下853016.790--100954022.2100--1101056033.3110--1201153016.7120以上1252011.1合计180100.0变量值次数频率下限上限开口组组距为10“上组限不在内”原则组数K=1+lgn/lg2(n为数据个数)组距=组中值=缺下限的开口组组中值=缺上限的开口组组中值=5.数据陈示

市场调查资料整理的最终结果需要借助于一定的形式表现出来,以供调研者和用户阅读、使用和分析研究。数据陈示的形式主要有统计表、统计图、数据库、数据报告等。8.1.2调查资料整理程序(1)目的性原则。市场调查资料的整理要服从于市场调查的目的要求,针对市场调研需要解决的问题,即用户管理决策的信息需求、有针对性地加工开发出以总括性数据与结构性(分类的)数据相结合的语法信息。(2)核查性原则。为确保数据处理质量,市场调查资料整理应注意事前、事中和事后都必须对数据质量进行核查,以求发现问题,查找差错,确保数据的准确性和可靠性。(3)系统化原则。市场调查资料的整理,不能停留在调查问卷或调查表数据的简单加工汇总上,应实行多方向、多层次的加工开发,以及调查项目之间的交叉开发,使加工开发的语法信息具有序列化,能最大限度地满足分析研究的需要。(4)时效性原则。不提高加工整理的效率,数据的时效性就会受到影响。因此,应利用计算机自动汇总技术、数据库技术等对数据进行及时加工处理,及时传输和反馈。调查资料整理的原则课堂小结任务指标表现要求已达要求未达要求(陈述性)知识掌握重要概念、特征和意义

(实践)技能

能进行职业操作活动

对课程内容的整体把握

能概述并认识整体知识与技能

与社会实践的联系程度

能描述知识与技能的实践意义

其他

8.2市场调查资料整理

8.2.1原始资料整理程序

从大的角度划分,市场调查资料整理可以分为实地调查获取的原始资料整理和文案调查获得的二手资料的整理。原始资料整理是指对问卷或调查表提供的原始数据进行加工整理和开发,即对经过审核的问卷或调查表中的原始数据进行分类和汇总,使数据系统化、综合化和条理化。

1.问卷登记与审核(1)审核的内容。如表所示:

8.2.1原始资料整理程序齐备性问卷或调查表的份数是否齐全,是否达到了调查方案设计的样本量的要求。完整性问卷或调查表填答的项目是否完整。不完整一般有三种情形:

大面积无回答或者相当多的问题无回答,应作废卷处理;

个别问题无回答应视为有效调查问卷,所留空白以后补救,或直接归入“暂未决定”、“其他答案”中;

相当多的问卷对同一问题无回答,仍作为有效调查问卷,对此项提问可作删除处理。准确性问卷或调查表中的项目是否存在填答错误,一般有三种情形:

逻辑性错误。明显不符事实,前后不一致。可用电话核实更正,无法核实,按“不详值”对待。

答非所问的答案。一旦发现应通过电话询问纠正,或者按“不详值”对待。

无兴趣回答的错误。一般是被调查者对回答的问题不感兴趣。如果仅属个别调查问卷,应彻底抛弃,如果有一定数目,且集中出现,应把这些问卷作为一个独立的子样本看待,在资料分析时给予适当的注意。时效性对调查问卷或调查表的访问时问、有关数据的时间属性进行检查,以评价调查数据是否符合时效性的要求。若延迟访问对调查结果没有什么影响,则问卷仍然是合格的;若延迟访问影响到数据的时间属性不一致时,则应废弃这样的调查表或问卷。真伪性对调查表或问卷的真实性进行检验,评价访问员是否存在伪造问卷或调查表的行为。一般采用抽样复检的办法进行核实。8.2.1原始资料整理程序

大规模市场调查项目收回的问卷或调查表往往是大量的,需要聘用审核员进行集中审核。审核的作业方式应该是在问卷或调查表分配给审核员的基础上,实行一卷或一表从头审到尾。即利用逻辑和经验判断的方法,检查问卷或调查表中的填答项目是否合理,项目之间有无相互矛盾的地方。(2)审核的方式干什么?逻辑审核计算审核即对数据进行计算性的检查,如分项相加是否等于小计,小计相加是否等于合计,数据之间该平衡的是否平衡。8.2市场调查资料整理根据资料统计分组时采用标志的多少,可以分为简单分组和复合分组两种分组方法。如按性别分,可以分为男生、女生。

选择恰当的分组标志。

确定分组界限。

按某一标志进行分组,不要遗漏任何原始资料所提供的数据,组距尽可能取整数,各组的组距尽可能相等,即尽可能多用等距分组,少用不等距分组。2.资料的分组分组方法分组操作分组意义

通过分组,可以对各种市场现象的类型在本质上进行区分。

可以用来分析、研究市场现象之间的依存关系以及因果关系。

通过分组能反映事物内部结构及比例关系,从而为企业寻找目标市场提供基础数据。8.2.1原始资料整理8.2市场调查资料整理是把原始资料转化为符号或数字的资料标准化过程。即给予每一个变量和可能答案一个符号或数字代码,也称为事前编码;如问题已经作答,则称为事后编码。一般来说,标准化的封闭式问卷资料的编码过程比较简单,常用事前编码,可节省时间。例8-4.编码概念封闭式问题编码开放式问题编码

列出答案。编码人员首先应尽可能地列出每个开放式问题的答案。当总体数量较小时,所有答案都应该列出。在大型调查活动中,也需列出一定数量样本的答案。

合并答案。根据开放式问题答案的性质,编码人员可以将相近类型的答案进行合并处理。3.编码8.2市场调查资料整理当所有问题答案编码都规定清楚之后,编码人员要编写一本编码手册,说明各英文字母、数码的意思。

录入人员可根据编码手册说明来录入数据

;研究人员或电脑程序员根据编码手册拟统计分析程序;

研究者阅读统计分析结果,不清楚各种代码的意义时,可以从编码簿中查询。编码手册概念作用举例:表8-43.编码变量代码变量含义题号变量名称是否跳答数据说明1长虹的知名度Q1Q1-1否1=选中,2=未选中2海尔的知名度Q1Q1-2否1=选中,2=未选中……

(一)预编码为了方便计算机处理,在设计问卷时就预先给这些答案设计了编码,这种编码方式称为预编码。实际上对于封闭式问题大多采用预编码方式。后编码是整理开放式问题答案并对其进行编码的有效方法。对开放式问题的答案进行整理和编码,不是机械性的作业。它所依据的不应该仅是答案的文字,更重要的是这些文字所能反映出来的被调查者的思想、认识和心理。(二)事后编码调查资料整理的编码与录入调查数据的编码、录入1)顺序编码法顺序编码法又称系列编码法,是指用一个标准对信息资料进行分类,并按照一定的顺序用连续的数据或字母进行编码的方式。例如,一项对家庭年收入的调查项目,把不同年收入的家庭划分为以下五个档次。20000元及以下(1)20000~40000元(2)40000~60000元(3)60000~80000元(4)80000元及以上(5)调查数据的编码、录入2)分组编码法分组编码法又称区间编码法,是根据调查事物的特性和信息资料分类及其处理的要求,将具有一定位数的代码单元分成若干个组,每一个组的数字均代表一定的意义。分组编码法编码简单,便于计算机处理,但位数过多,容易造成系统维护上的困难。调查数据的编码、录入个人基本情况的调查性别居住地家庭人口数月收入水平回答编码回答编码回答编码回答编码

男1大城市1单身13000元以下1

女2中小城市2两人23000~6000元2县镇3三口之家36000~9000元3农村4四人及以上49000~12000元412000元以上5若某被调查者的信息是:女性,居住地某大城市,单身,月收入3000~6000元,信息码是2112。调查数据的编码、录入3)信息组码编码法信息组码编码法,是指把调查信息资料区分成一定的组,每个组给予一定的组码进行编码的方法。某地市场商品价格变动情况的调查,调查组码分类如下:级别名称码百货组01~25食品组26~50服装组51~70家电组71~80其他组81~100调查数据的编码、录入4)表意式文字编码法表意式文字编码法,又称助记编码法,是用数字、文字、符号等表明编码对象的属性,并依此方式进行信息资料编码的方法。例如,用210BXJ表示容量为210升的进口电冰箱,其中210为暗箱容量,BX表示冰箱,J表示进口。这种编码方法表现直观,易于理解,便于记忆。

案例:电脑用户情况调查编码对照表

1、您的年龄是

18岁以下18-30岁31-50岁50岁以上

2、选购电脑时经销商的介绍对您的影响程度是

0102030405060708090100(%)

3、您选购电脑时,可能会考虑各种因素,请您按先后顺序进行排序

价格品牌功能售后服务

4、其他条件不变时,如果电脑系列产品平均降低售价10%,您的态度是

马上购买会来购买比较后再看

没有吸引力不会来购买肯定不购买

问题1编号答案类别1118岁以下

218-30岁

331-50岁

450岁以上

问题3编号答案类别

1价格编号答案类别

2品牌编号答案类别

3功能编号答案类别

4售后服务问题2编号答案类别

10—10210—20320—30430—40540—50650—60760—70870—80980—901090—100问题4编号答案类别

1马上购买

2会来购买

3比较后再看

4没有吸引力

5不会来购买

6肯定不购买

案例:调查答案综合表

回答者序列号问题顺序1233334001253124200237213430033723141________________________________1004824131调查数据的编码、录入2.调查数据的录入(1)数据录入的含义数据录入,是将经过编码的数据资料输入到计算机存储设备中的过程。市场调查发达的国家在数据采集中常常采用计算机辅助电话调查(CATI)、计算机辅助面访(CAPI)等调查方式,计算机录入工作在调查访问时就完成了。调查数据的编码、录入(2)数据录入质量的检查1)数据库软件自动检查法通过数据库结构的编辑,可以对录入的过程进行逻辑检查,避免数据录入过程中出现某种类型的逻辑错误。2)重复输入数据重复输入数据的核查方式主要有双机录入或三机录入。双机录入,是指将同一份问卷,分别由两个录入人员在计算机上进行两次录入,将两次录入的结果逐一进行比较,相同的部分被认定为没有错误,不同部分立即检查问卷进行核对,及时修正错误;8.2市场调查资料整理数据的录入形式有两种,一种是以单独数据文件的形式录入和存在,另一种是直接录入专门的统计分析软件中(如Excel、SPSS)。缺失数据也称缺失值。数据录入中,经常会遇到先分析数据缺失的原因,有个别问题未作答,或是调查员没有记录造成数据缺失。录入缺失值处理录入数据缺失值缺失值处理(1)找一个中间变量代替。(2)用一个逻辑答案代替。(3)删除处理。数据录入、缺失值处理缺失数据的处理1.返回现场工作存在不合格回答的问卷可能返回给现场,由访谈人员与调查对象重新联系。这种方法特别用于企业或行业的市场营销调查,因为样本容量通常比较小,调查对象也比较容易确认。2.填补缺失值如果无法把问卷返回调查现场,编辑人员也可以考虑填补不合格问卷中的缺失值。这种方法适用于:①有缺失值的问卷数较少;②每份有缺失值的问卷中的缺失值所占的比例较小;③有缺失值的变量不是关键变量。3,丢弃不合格问卷这种方法适用于:①不合格问卷比例小时(不超过10%);②抽样数量很大时;③不合格问卷与合格问卷没有表现出明显的差别(比如调查对象的人口特征、产品使用特性);④每份不合格问卷中不合格答案占较大比重;⑤关键变量值缺失。缺失数据的处理1.推理插补推理插补,是对缺失或不一致的数据通过推断来确定。这种推理一般是根据数据资料中其他回答项的数据推理得来的。例如,一个三项数值的和是100,其中的两项分别是30和40,剩下的一项数值可以推算出是30。其数据间的逻辑关系是,第三项数值是三项数值之和与已知两项数值之差。缺失数据的处理2.均值插补均值插补,是对缺失或不一致的数据用数列的均值来代替的插补方法。(1)当原数列没有明显升降趋势和季节波动时,用整个数列的平均值插补缺项。(2)当原数列各期增(减)量大体相同时,可以用前期数据加平均增(减)量来插补缺项。缺失数据的处理3.比例插补,是根据事物之间的比例关系推算所缺数据的插补方法。4.热平台插补热平台插补是使用相似类型被调查者的已有记录的信息(供者)来代替一个缺失的或不一致的数据(受者)。8.2市场调查资料整理

8.2.2二手资料整理程序二手资料的加工整理是指对文案调查法、网络调查法等方法收集的次级资料进行再加工整理,使之符合调研者对特定的市场问题研究的需要。

1.二手资料确认

确认又称甄别,是指对二手资料的真假、准确性、时效性、可靠性进行检查判定,以便从中选定那些可供利用的资料。

2.二手资料评价

评价是根据当前问题研究的需要,对所选定的二手资料的可利用程度进行评价,以判别哪些资料可直接利用。

3.二手资料加工

加工就是对不能直接利用的二手资料进行改造制作,使之符合分析研究的需要。

4.二手资料整理

二手资料经过确认、评价、加工之后,为了使历史数据和有关资料实现有序化,更好地满足分析研究的需要,还应对二手资料进行整理。主要包括数据的列表陈示、各类统计表的汇编、编印资料手册、文献资料的分门别类、归档管理等。8.2.2二手资料整理程序课堂小结任务指标表现要求已达要求未达要求(陈述性)知识掌握重要概念、特征和意义

(实践)技能

能进行职业操作活动

对课程内容的整体把握

能概述并认识整体知识与技能

与社会实践的联系程度

能描述知识与技能的实践意义

其他

8.3.1制表分析1.交叉列表分析交叉列表分析是同时将两个或两个以上具有有限类目数和确定值的变量,按照一定顺序对应排列在一张表中,从中分析变量之间的相关关系,得出科学结论的技术。8.3市场调查资料分析8.3.1制表分析1.交叉列表分析(1)单变量列表8.3市场调查资料分析8.3.1制表分析1.交叉列表分析(2)双变量交叉列表8.3市场调查资料分析8.3.1制表分析1.交叉列表分析(3)三变量交叉列表8.3市场调查资料分析四大都市拥有冰箱的家庭中冰箱台数拥有情况

所在城市冰箱拥有量1台2台3台或3台以上北京85%13%2%成都92%8%8%上海93%6%1%广州96%3%3%小案例要研究四大都市的家庭中拥有冰箱台数情况,我们以消费者所在城市为标志,将消费者划分为北京、成都、上海、广州四组;再按拥有冰箱的台数将拥有一台的归为第一组,拥有两台的归为第二组,3台或3台以上的归为第三组。所在城市冰箱品牌海尔华凌伊莱克斯上菱北京44%0%9%0%成都53%1%3%1%上海31%0%6%18%广州13%27%4%0%四大都市拥有冰箱的家庭中冰箱台数拥有情况

[小案例]以某项研究时装购买和婚姻状态之间关系的市场调研项目为例。变量时装购买情况分为高和低两种状态。变量婚姻状态也分为两种状态:已婚和未婚。对1000个消费者样本调查资料如下表所示时装购买状况性别男性女性婚姻现状婚姻现状已婚未婚已婚未婚高35%40%25%60%低65%60%75%40%列总计100%100%100%100%被调查者数4001203001808.3.2制图分析1.常用制图分析(1)比较图8.3市场调查资料分析8.3.2制图分析1.常用制图分析(2)结构图8.3市场调查资料分析8.3.2制图分析1.常用制图分析(3)动态图8.3市场调查资料分析8.3.2制图分析1.常用制图分析(4)依存关系图8.3市场调查资料分析(一)折线图

(二)直方图

(三)条形图

(四)饼状图(五)柱形图

(六)散点图

(七)圆环图

(八)气泡图

调研结果的表述图形购买场所VS性别图形图形图形非常满意 满意 比较满意 介于满意与不满意之间 比较不满意 不满意 非常不满意平均值图形统计指标分析是根据一定时期的资料,对总体的各种数量特征,例如,总体的规模、结构、水平、比例关系等进行分析的方法。其中,统计指标是指反映总体的数量特征的概念和具体数值。通常,一个完整的统计指标包含指标名称和指标数值两部分(实际工作中,人们有时只把指标名称称作指标,而不将指标数值包含在内),例如,工业总产值10000亿元,产品零售总额5000万元等。统计指标分析是根据一定时期的资料,对总体的各种数量特征,例如,总体的规模、结构、水平、比例关系等进行分析的方法。其中,统计指标是指反映总体的数量特征的概念和具体数值。通常,一个完整的统计指标包含指标名称和指标数值两部分(实际工作中,人们有时只把指标名称称作指标,而不将指标数值包含在内),例如,工业总产值10000亿元,产品零售总额5000万元等。统计指标分析是根据一定时期的资料,对总体的各种数量特征,例如,总体的规模、结构、水平、比例关系等进行分析的方法。其中,统计指标是指反映总体的数量特征的概念和具体数值。通常,一个完整的统计指标包含指标名称和指标数值两部分(实际工作中,人们有时只把指标名称称作指标,而不将指标数值包含在内),例如,工业总产值10000亿元,产品零售总额5000万元等。8.3.3调查资料的描述分析总量指标分析相对指标分析数据集中趋势分析数据离中趋势分析总量指标总量指标是反映总体在一定时间、空间条件下的规模或水平的统计指标,通常以绝对数表示,因此又称绝对数指标。总量指标按其反映的时间状态不同可以分为2种指标。时期指标01.时点指标02.总量指标时期指标与时点指标的区别如下。区别(1)不同时期的时期指标的数值具有可加性,相加后表示某一事物在较长时期中的总的发展水平。(2)时期指标的数值大小与时期长短有直接关系,一般情况下,时期越长,指标数值越大,时期越短,指标数值越小;而时点指标的数值大小与其时/间间隔长短无直接关系。(3)时期指标数值是连续登记、累计的结果。时期指标国内生产总值(GDP):是一个国家(或地区)所有常住单位在一定时期内生产活动的最终成果,通常按季度或年度进行统计。它反映了一个国家或地区在一段时间内经济活动的总规模和总水平。产品产量:指企业在一定时期内生产的产品数量。如某汽车厂一年生产汽车的数量,它体现了企业在该时期内的生产成果,可按日、月、季、年等不同时间段进行统计,时间段越长,产量通常越高。商品销售额:是商业企业在一定时期内销售商品的货币金额。例如,一家商场在一个月内销售各种商品的总金额,反映了该商场在这段时间内的销售业绩,可用于分析市场销售情况和企业经营状况。人口出生数:是指在一定时期内(如一年)出生的人口数量。它是反映人口自然增长情况的重要指标,对于研究人口变化趋势、制定相关政策具有重要意义。时点指标年末人口数:指一个国家或地区在年末这一特定时刻的人口总数。它是一个静态的指标,不随时间的推移而累加,只反映某一时刻的人口规模,常用于人口统计和分析。企业固定资产净值:是指企业在某一时点上固定资产的账面价值,即固定资产原值减去累计折旧后的余额。它反映了企业在该时点上固定资产的实际价值,是评估企业资产状况的重要指标之一。库存商品结存数:指企业在某一特定时点上库存商品的实际数量。例如,在月末最后一天盘点时,仓库中剩余的商品数量,它不涉及一段时间内的变化情况,仅反映当时的库存状态。银行存款余额:是指客户在银行账户中某一时刻的存款金额。如在某一天的营业结束时,账户内的资金余额,它是一个时点数据,用于反映客户在该时点的资金持有情况。(一)结构相对数概念:结构相对指标是在对总体进行分组的基础上,各组数值与总体数值对比得到的相对数。用来反映社会经济现象总体内部的构成情况,说明总体内各部分在总体中的地位。201520162017201820192020第一产业20.520.419.118.617.715.9第二产业48.849.550.049.349.450.9第三产业30.730.130.932.132.933.2相对指标分析

(二)比例相对指标

比例相对指标又称比例相对数,是在同一时间内同一经济现象的总体内部不同部分指标数值之间的比例关系,用来表示总体内部各组成部分的构成比例。比例相对指标可用百分数或系数来表示,也可用1:m:n的连比形式表示。例:某年我国人口主要构成情况指标年末数比重(%)全国总人口130756100.0其中:城镇56212

乡村74544其中:男性67375

女性6338143.057.051.548.5

(三)比较相对指标比较相对指标是把同一时间内同类经济现象的指标在不同空间状态下的数值对比构成的相对指标。它可以反映同类事物在不同国家、不同地区或不同单位之间的差异程度,一般用百分数、系数或倍数表示。分子与分母可以互换例:中国国土面积为960万平方公里,美国为937万平方公里,两者之比为例:某年有甲、乙两企业同时生产一种性能相同的产品,甲企业工人劳动生产率为19,307元,乙企业为27,994元。说明甲企业劳动生产率比乙企业低31%。

(四)强度相对指标强度相对指标是性质不同但又有密切联系的两个不同总量指标之比。用来表明现象的强度、密度、普通程度和利用程度,常用来比较不同国家、地区或部门的经济实力或为社会服务的水平。其计算公式:

例1998年末我国人口密度

正指标:越大越好例:每千人拥有的零售商业机构个数逆指标:越小越好例:每个商业机构所服务的人数某城市人口100万人,有零售商业机构5000个,则:有些强度相对数有正、逆两种计算方法:

(五)动态相对指标动态相对指标又称发展速度,它是同类现象在不同时间上对比关系,说明现象发展变化的方向和程度。其计算公式为:基期

——作为对比标准的时期报告期

——

同基期比较的所要研究的时期

例:某大学在校生人数2018年10000人,2019年为15000人,则该校在校生人数2019年是2018年的150%。即:动态相对指标=10年间,大学生增长了50%同比发展速度公式和环比发展速度的计算公式如下所示.2019年某平台“双11”的单日销售总额为100亿元,2020年该平台“双11”的单日销售总额为220亿元,则2020年该平台单日销售总额的同比发展速度为220%,或表示为同比增长120%。某企业2020年11月的销售额为200万元,12月的销售额为300万元,则2020年12月的销售额的环比发展速度为多少?如果该企业2019年12月的销售额为150万元,则2020年12月销售额的同比发展速度为多少?例题:想一想可以计算哪几种相对指标?单位:万人

根据第四次人口普查调整数1982年1990年人口总数其中:男女10165452352493021143335890455429又知我国国土面积为960万平方公里。结构相对指标比例相对指标比较相对指标强度相对指标动态相对指标√√√×√完成程度相对指标:某种现象在某一段时间内的实际完成量与计划完成量进行对比得到的比值。公式:练习:1.某企业某年计划销售额为5000万元,当年该企业实际销售额为5500万元,则该企业的完成程度相对指标是多少?2.某App的男用户数为1200万人,女用户数为1000万人,则该App的比例相对指标是多少?

3.将2020年A企业钢产量和B企业钢产量进行比较,A企业钢产量为2000吨,B企业钢产量为1000吨,则A企业钢产量是B企业钢产量的(

)倍;B企业钢产量为A企业钢产量的(

)。说明:比例相对指标是同一个总体内的不同组成部分的指标值的对比。比较相对指标是同一时期同类指标在空间上的对比,说明的是同类现象发展的不均衡程度。结构相对指标计算:某企业生产A、B、C三种产品,2024年全年总销售额为8000万元,其中A产品销售额为3000万元,B产品销售额为2500万元,C产品销售额为2500万元。计算三种产品销售额各占总销售额的比重。​比例相对指标计算:某班级共有学生50人,其中男生30人,女生20人。计算该班级男女生人数的比例相对指标。3.强度相对指标计算:已知某城市2024年的国内生产总值(GDP)为5000亿元,年末常住人口为800万人。计算该城市2024年的人均GDP。​4.动态相对指标计算:某公司2023年的利润为1500万元,2024年利润增长至1800万元,求该公司2024年利润相较于2023年的动态相对指标。​5.比较相对指标计算:甲、乙两城市,甲城市2024年汽车产量为80万辆,乙城市同年汽车产量为50万辆,计算以甲城市为对比基础,乙城市汽车产量的比较相对指标。结构相对指标计算:​A产品销售额占比=(A产品销售额÷总销售额)×100%=(3000÷8000)×100%=37.5%​B产品销售额占比=(B产品销售额÷总销售额)×100%=(2500÷8000)×100%=31.25%​C产品销售额占比=(C产品销售额÷总销售额)×100%=(2500÷8000)×100%=31.25%​比例相对指标计算:​男女生人数比例相对指标=男生人数∶女生人数=30∶20=3∶2,也可写成女生人数∶男生人数=20∶30=2∶3,一般习惯以较小数作为对比基础,用倍数或分数表示。这里以女生人数为对比基础,男生人数是女生人数的30÷20=1.5倍;以男生人数为对比基础,女生人数是男生人数的20÷30=2/3。​强度相对指标计算:​人均GDP=国内生产总值÷年末常住人口=5000亿元÷800万人=6.25万元/人​动态相对指标计算:​动态相对指标(发展速度)=(报告期水平÷基期水平)×100%=(2024年利润÷2023年利润)×100%=(1800÷1500)×100%=120%​比较相对指标计算:​比较相对指标=(乙城市汽车产量÷甲城市汽车产量)×100%=(50÷80)×100%=62.5%,表示乙城市汽车产量是甲城市汽车产量的62.5%。

1.集中趋势分析

集中趋势分析在于揭示被调查者回答的集中程度。数据的集中趋势是指大部分变量值趋向于某一点,将这点作为数据分布的中心,数据分布的中心可以作为整个数据的代表值。8.3.3调查资料的描述分析招聘启示我公司开发部现有人员9名,月平均工资3000元,现招聘员工一名。青城泡菜公司2014年3月招聘启示我公司开发部现有人员10名,月平均工资2000元,现招聘员工一名。芳芳瓜子公司2014年3月经理12000副经理7500员工11500员工21500员工31000员工4900员工5900员工6900员工7800

青城泡菜公司

平均工资

3000元

芳芳瓜子公司

平均工资

2000元经理2600副经理2250员工12150员工22100员工32050员工41950员工51900员工61900员工71900员工81200张村有个张千万,隔壁九个穷光蛋。平均起来算一算,人人都是张百万。众数中位数平均数数据集中趋势分析单项式分组组距式分组未分组资料分组资料单项式分组组距式分组简单算术平均数加权算术平均数

1.集中趋势分析

(1)平均数。平均数是总体中各单位标志值之和除以单位总数得到的数值,是最常用的集中趋势分析指标。8.3.3调查资料的描述分析

1.集中趋势分析

(2)众数。众数是数据中出现次数最多的变量值,也是测定数据集中趋势的一种方法,它克服了平均数指标会受数据中极端值影响的缺陷。8.3.3调查资料的描述分析

1.集中趋势分析

(3)中位数。中位数是将数据按某一顺序(从大到小,或相反)排列后,处在最中间位置的数值。8.3.3调查资料的描述分析(1)根据单项式数列确定众数在单项式数列情况下,确定众数比较简单,只需要观察找出次数出现最多的那个标志值即可。(2)根据组距式数列确定众数根据组距式数列确定众数,需采用插补法。一般步骤是先确定众数组,然后计算众数的近似值。例题2003年某地区职工家庭人均月收入资料见下表。一、众数众数是指总体中出现次数最多的标志值。上网次数被访问者一次18二次20三次21四次33五次15六次13七次10合计1302003年某地职工家庭人均月收入资料表人均月收入(元)家庭户数(户)300以下300~400400~500500~600600~700700~800800~900900~10001000以上2606601800320020001000800600400合计

10720从上表中的家庭户数列可知,家庭户数最多的是3200户,它所对应的人均月收入为500~600元。因此,500~600元这一人均月收入组就是众数组,它反映了人均收入的一般水平。然后利用下限公式或上限公式计算众数的近似值:下限公式:上限公式:

式中,M0——众数;U——众数组的上限;L——众数组的下限;

Δ1——众数组次数与前一组次数之差;

Δ2——众数组次数与后一组次数之差;i——组距。根据表中的资料,将有关数字代入下限公式,得到众数的近似值:1.根据未分组资料确定中位数①将标志值按大小排序②确定中位数所在的位置中位数位置=如果标志值的基数是奇数,那么中间位置的那个标志值,就是中位数。中位数中位数是指将总体各单位标志值按大小顺序排列后,处于中间位置的那个标志值。例如:某班组有7名工人,日生产零件数分别为16,17,18,20,21,22,23件,则中位数所在位置为第4位[(7+1)/2],第4位所对应的标志值,即20件就是中位数,它代表了这7名工人日生产零件数的一般水平。

以上是标志值的项数是奇数的情况。假如上述班组还有1名学徒工人,日生产零件为14件,那么他们生产零件数按顺序排列为14,16,17,18,20,21,22,23件。此时中位数的位置为第4.5位[(8+1)/2],则中位数为19件[(18+20)/2],即第4位和第5位所对应的标志值的算术平均数。

某项对消费者每月去大型超市购物次数的调查,20个被调查者每月去大型超市的次数按顺序排列是:0,1,1,1,2,2,2,2,3,3,3,3,3,4,4,4,5,5,6,7,则中位数是多少?解:这说明中位数的位置在第10位和第11位中间,因此,中位数应是第10个数与第11个数的算术平均数。即等于32.根据分组资料确定中位数①根据单项数列确定中位数这时要考虑标志值的分布情况,按一定方法计算累计次数(向上累计和向下累计)。例题:某学院2002~2003学年共有30名同学获得奖学金,其分布情况见下表。

学生奖学金分布情况计算表

由上表资料计算得中位数位置为30÷2=15,即中位数在第15人位置上。奖学金金额(元/人)人数(人)人数累计向上累计(人)向下累计(人)300500800100015003687639172430302721136

合计30

-方法与从原始数据计算中位数的方法大致相同,首先也是求出中间位置,然后找出对应的数值。只不过寻找的方式有所不同。首先由公式计算中间位置:即中间位置在第15个数值与第16个数值之间。为了找到这个位置,需要先列出累计频数。然后我们从上往下找,看看所求出的中间位置首先落在哪一个累计频数内,再由此找出相对应的中位数。

②根据组距式数列确定中位数

按餐饮收入分组(万元)城市数(个)累计城市数(个)向上累计向下累计5000以下5000~1500015000~2500025000~3500035000以上4985441321263030261794合计30——确定中位数的基本步骤如下:第一步,确定中位数所在的组。中位数位置===15由此可知,中位数在餐饮收入为15000万~25000万元的这一组里。第二步,运用下限或上限公式进行计算,以求得近似的中位数数值。

一般用以下两个公式估算中位数值:

下限公式:上限公式:

Me——中位数;

L——中位数所在组的下限;

U——中位数所在组的上限;

Sm-1——中位数所在组前一组的向上累计次数

Sm+1——中位数所在组后一组的向下累计次数

fm——中位数所在的次数;

i——中位数所在组的组距;∑f——总次数。

按下限公式可得中位数:

某企业职工月工资资料如下表所示,试确定其中位数月工资(元)人数(人)向上累计向下累计500~600110600~700180700~800320800~900460900~10008501000~11002501100~12001301200~1300701300~1400201400~150010

合计2400(3)算术平均数1)简单算术平均数,是在未分组的资料条件下计算简单算术平均数,其公式为:2)加权算术平均数,在资料已分组并得出次数分布资料时,要计算加权算术平均数,其公式为:

平均日产量==18.4(件)该车间日平均生产零件18.4件,它代表这个车间日生产零件的一般水平。【例1】某车间7名工人,日生产零件分别为16、14、18、21、23、19、18件,试问该车间零件日均产量?简单算术平均数是总体标志总量与总体单位总量相比求出的平均数。其计算公式为:式中:表示简单算术平均数;表示总体标志总量;表示各单位标志值;表示总体单位总数。

(二)加权算术平均数【例2】某商场鞋帽部有16名职工,按日销售额分组,得到的变量数列资料见下表,试计算职工平均日销售额。按日销售额分组(元/人)职工人数(人)日销售额(元)220026002800300032002345244007800

11200150006400

合计1644800根据上表的资料,计算平均日销售额如下:平均日销售额=

==

=2800(元)在该平均数的计算中,不仅涉及到变量值x,还涉及到另一个反映变量值出现次数的量,用“f”表示。则有:

=

=该计算公式表明,平均数的大小,不仅取决于总体各单位标志值的大小,而且还受到各单位标志值出现次数的影响。所以,式中的“f”在此起着“权衡轻重”的作用,故统计学中将其称为权数,将以上的计算方法称为加权算术平均法。例题:已知某职工人数及工资总额资料,见下表计算该饭店职工的平均工资。某职工人数及工资总额资料

部门工资额(元/人)职工人数(人)客房部餐饮部商品部830910102656439合计——108

解:平均工资

=

=

==878元/人2010年某院校大学生生活费用支出情况生活费用支出元学生人数

500以下29500—70077700—90027900—1100以上241100以上13合计1702010年某院校大学生生活费用支出情况学生人数组中值生活费用支出元

人数乘组中值500以下2940011600500—7007760046200700—9002780021600900—1100以上241000240001100以计170—119000

2.数据的离散趋势分析

数据的离散程度分析是指数据在集中分布趋势状态下,同时存在的偏离数值分布中心的趋势。离散程度分析是用来反映数据之间的差异程度的。8.3.3调查资料的描述分析数据的离中趋势分析(1)极差极差是数据中最变量大值和最变量小值之差。其基本公式为:极差=最变量大值—最变量小值案例某高校有8位学生,他们每月的生活费支出分别是:500、550、600、650、700、750、800、850元则他们生活费支出的极差:极差=850-500=350(元)极差受最变量大值和最变量小值的影响,如果因特殊原因出现特别大或特别小的数值,极差就不能确切反映各数据真实的变异程度。全距的特点:反映了总体各单位标志值的变动范围。它的优点是计算简便,意义明确、能准确地反映总体中两极的差距。缺点:全距仅表示总体各单位标志值的变动范围,没有包括中间各标志值的变异情况,也无法反映变量数列的次数分布情况,是对变异程度较为粗略的反映。因此,它不能反映总体未必会变异程度,也不能很好地反映平均指标的代表性。(2)平均差平均差,即平均离差。它是将各变量值与平均数离差绝对值的总和除以离差的项数。计算公式分为简单和加权两种。1)对于未分组资料,采用简单式计算,其公式为:

2)对于分组资料,采用加权式计算,其公式为:

为各组单位数(次数)。2010年某院校大学生生活费用支出情况生活费用支出元

500以下294003008700500—700776001007700700—900278001002700900—1100以上24100030072001100以上1312005006500合计170——32800生活费用支出元

500以下294003008700500—700776001007700700—900278001002700900—1100以上24100030072001100以上1312005006500合计170——32800(3)平均差系数平均差系数是将平均差除以相应的平均指标得到的数值。计算公式为:平均差系数=%(4)均方差(标准差)1)对于未分组资料,采用简单式计算,其公式为:2)对于分组资料,采用加权式计算,其公式为:式中,表示标准差。

例已知平均成绩为80分,以上例考试成绩为例,说明简单标准差的计算。单位:分

女学生组男学生组成绩(x)成绩(x)68707276808285888990144100641604256481100606263657688959697984003242892251664225256289324合计598合计2412根据上表中的资料,女学生组成绩的简单标准差为:男生组成绩的简单标准差为:

例:仍以某商场食品部职工日销售额资料为例,说明加权标准差的计算,见下表:按日销售额分组(元/人)x职工人数(人)f离差离差平方离差平方加权2200260028003000320023452-600-2000200400360000400000400001600007200001200000200000320000合计16—6000001360000根据上表中的资料,加权算术平均数为2800元/人,计算加权标准差为:(5)均方差系数均方差系数是均方差与相应的平均数对比而得出的相对数值。其计算公式为:式中,表示均方差系数

例某班两组学生英语考试成绩见下表:

一组二组成绩(分)人数(人)成绩(分)人数(人)647076828813542707376798224531合计15合计15

试问哪一组学生平均成绩的代表性大?为什么?通过计算可知,一组学生的平均成绩是77.2分,二组学生的平均成绩是75.4分,两组成绩的标准差分别为6.6453分和3.3226分。根据标准差系数公式,得出显然二组的标准差系数小于一组,即二组成绩的变异程度低于一组,所以二组平均成绩的代表性高于一组。标准差系数的重要特点是,不受计量单位和标志值水平的影响,消除了不同总体之间在计算单位、平均水平方面的不可比性。

例:有两组工人日产量

甲组:60、65、70、75、80

乙组:2、5、7、9、12

不能简单断言甲组离散程度大于乙组离散程度

可以计算离散系数本例中即乙组的离散程度大于甲组。由此可见,当我们比较两组数据的离散程度时,如两组平均数相等,可以直接比较标准差;如两组平均数不等,则需比较两组的离散系数。1.SPSS(statisticalPackagefortheSocialSciences),即“社会科学统计软件包”是世界著名的数据统计分析软件之一。迄今已有30余年的成长历史。是世界上应用最广泛的专业统计软件。2.特点

操作简便,界面友好。除了数据录入及部分命令程序等少数输入工作需要键盘键入外,大多数操作可通过鼠标拖曳、点击“菜单”、“按钮”和“对话框”来完成。

编程方便。具有第四代语言的特点,告诉系统要做什么,无需告诉怎样做。

功能强大。具有完整的数据输入、编辑、统计分析、报表、图形制作等功能。

全面的数据接口。能够读取及输出多种格式的文件。

针对性强。SPSS针对初学者、熟练者及精通者都比较适用。8.3.4统计分析软件SPSS课堂小结任务指标表现要求已达要求未达要求(陈述性)知识掌握重要概念、特征和意义

(实践)技能

能进行职业操作活动

对课程内容的整体把握

能概述并认识整体知识与技能

与社会实践的联系程度

能描述知识与技能的实践意义

其他

实训名称:市场调查资料整理□实训目的:初步认识市场调查资料分组工作□实训内容:选择某一老少皆宜的日常消费品,由学生设计问卷对本市不同年龄段的受访者进行调查,然后按年龄段将调查所得资料进行分组,尝试总结出自己的调查结论。□实训组织:学生分小组,根据特定目的,讨论并对数据资料进行分组;讨论市场调查资料分组的合理性与科学性,以及对于揭示市场调查目的的意义。实训总结:学生小组交流对调查数据资料分组的结果,教师根据讨论报告、PPT演示、讨论分享中的表现分别给每组进行评价打分。实训项目1.()是统计调查的继续、统计分析的前提。A.统计准备B.统计分析C.统计报告D.统计整理2、某外商投资企业按工资水平分为四组:1000元以下,1000~1500元;1500~2000元;2000元以上。第一组和第四组的组中值分别为(

A、750和2500

B、800和2250

C、800和2500

D、750和22503.甲乙两数列,甲数列的标准差大于乙数列的标准差,则两个数列的平均数的代表性为().A、甲大于乙B、乙大于甲C、相同D、无法判断4.某市2004年农村人均收入和城市人均收入分别为4800元和10060元,标准差分别为320元和780元,则人均收入的变异程度(

)。

A.

城市大

B.

一样大

C.

农村大

D.

不可比5.某市2004年农村人均收入和城市人均收入分别为4800元和10060元,标准差分别为320元和780元,则人均收入的代表性(

)。

A.

城市大

B.

一样大

C.

农村大

D.

不可比

6、将人口总体按“职业”分类是按照()分组的。A.数量标志 B.品质标志C.品质与数量标志 D.变量值7、下列分组中哪个是按品质标志分组()A、企业按年生产能力分组B、产品按品种分组C、家庭按年收入水平分组D、人口按年龄分组8.在编制统计表的基础上,为了使统计资料的表达直观生动、通俗易懂,往往需要绘制()。A.统计图 B.统计表格 C.统计曲线 D.统计地图9。()是指用直线段依次联结各散点而形成的折线的升降起伏来表示被研究现象的变动情况及其发展趋势的图形。 A.折线图 B.圆饼图 C.条形图 D.散点图10()是以若干宽度相等的平行条形的高低或长短来表示统计数字资料的图形。 A.折线图 B.圆饼图 C.条形图 D.散点图1.某班级10名学生的数学考试成绩分别为:65、70、75、80、80、85、90、90、95、100。计算该组数据的均值、中位数、方差和标准差。2.某公司员工的月工资(单位:元)数据如下:3000、3500、3500、4000、4000、4000、4500、4500、5000、5000。计算众数、均值、极差和方差。方差是用来衡量一组数据离散程度(波动程度)的统计量。它通过计算各数据与这组数据均值的偏离程度的平均值来反映数据的分散情况。某市场调查公司对某地区居民每月在

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论