市场调查与预测(第5章).ppt_第1页
市场调查与预测(第5章).ppt_第2页
市场调查与预测(第5章).ppt_第3页
市场调查与预测(第5章).ppt_第4页
市场调查与预测(第5章).ppt_第5页
已阅读5页,还剩29页未读 继续免费阅读

付费下载

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、第五章市场调查的抽样设计,5.1抽样调查概述,5.2概率抽样技术,5.3非概率抽样技术,5.4抽样方法的选择和样本容量的确定,5.1抽样调查概述,5.1.1非综合调查(1)重点调查是指从被调查对象的综合单位中选择若干重点单位进行深入调查并掌握一定数据的调查。 以便估计被调查对象的总体情况(2)典型调查是一种调查组织形式,其中根据调查目的选择一个或几个具有代表性的单位作为典型单位,并且利用具有代表性的典型单位的调查结果来推断总体调查组织。 抽样调查抽样调查也称为抽样调查。它是一种统计调查方法,根据科学的原理和方法,从由几个单位组成的整体中抽取一些样本单位进行调查和观察,并利用获得的调查标志数据来

2、推断总标志数。特点:调查样本是随机选取的。而不是用随机选择的单个单位来代表整体。调查样本的数量有可靠的保证。调查结果的准确性相对较高。抽样调查中的几个概念(1)总体和样本总体也称为总体和总体,矩阵是指供研究者研究的组或元素集,即整个调查对象。根据人口单位的数量,人口可以分为有限人口和无限人口。样本是整体的一部分,它是由整体的一部分按照一定的程序从整体中选出的集合。每个被选中的个体被称为一个样本单元。(2)抽样框架和抽样单位抽样框架也称抽样结构,是指列出可作为样本选择的总体单位的名册或排序编号,以确定总体抽样范围和结构。构成采样框架的单位称为采样单位或采样单位。在群集抽样中,群集是抽样单位,群集

3、可能包含相当多的基本单位。(3)总体特征和估计量总体特征是整体的某一特征或属性的定量表达。估计器是从样本的第n个单元计算的总体特性的估计。(4)抽样分布对于一个固定的总体,在一定的样本设计和样本量条件下,估计量的所有可能值及其出现概率的序列都是估计量的抽样分布。在大样本的情况下,正态分布可以用于区间估计。(5)误差和精度非抽样误差不是由抽样引起的,而是包括调查误差、抽样框架不完整引起的误差、非回答误差和填写或输入调查数据时的误差。非抽样误差与样本大小无关。抽样误差是由抽样引起的误差,抽样误差是用样本数据估计总体特征引起的代表性误差。采样误差可以测量,也就是说,它可以用各种值来表示,并且可以控制

4、。抽样类型(1)非概率抽样非概率抽样使用主观(非随机)方法从总体中选择单位。适用于;首先,作为设计概率抽样调查的第一步;二是帮助了解调查后期的概率抽样调查结果;第三,概率抽样无法实现,非概率抽样是唯一可行的选择。常见的非概率抽样方法主要有:随机抽样;自愿抽样;判断抽样;配额抽样;雪球抽样。(2)概率抽样概率抽样是根据随机原理进行的抽样。概率抽样可用于相对准确地推断调查人群。概率抽样有两个基本标准:首先,单位是随机选择的;其次,调查人口中的每个单位都有非零的抽样概率,这些概率是可以计算的。概率抽样的优点是根据调查结果得到的总体估计值相对可靠,可以计算出每个估计值的抽样误差。概率抽样的缺点是,与非

5、概率抽样相比,概率抽样更加复杂、耗时,而且通常更加昂贵。但总的来说,它的优势远远大于劣势。5.1.4抽样步骤,5.2概率抽样技术,5.2.1简单随机抽样(1)简单随机抽样的概念,又称简单随机抽样,SRS抽样,是一种基本的抽样方法,即抽样调查单位完全随机地从整个人口中抽取,不进行任何分组、分类、排队等。(2)简单随机抽样的实现常用的抽样方法有抽签法、随机数表法和计算机抽取法。计算机生成的随机数是伪随机数。随机数表(节选),这是一个多位数的表,由十个数字组成,从0到9随机排列。目前,世界上有很多种随机数表。其中,较大的一个是:1955年,兰德公司编制的100万数字随机数表出版了。五人一组,共20万

6、组;1938年,肯德尔和史密斯编制的10万位随机数表出版了。它也是五人一组,共25000组。中国常用的是中国科学院数学研究所概率统计办公室编制的常用数理统计表中的随机数表。5.2.2分层随机抽样,(1)分层随机抽样的概念(分层抽样)也称为类型抽样,STR抽样,它根据整体单元的属性特征将其分为若干类型或层,然后从类型或层中提取样本,所得样本称为分层样本。如果每一层的抽样都是按照简单的随机抽样独立进行的,那么这种抽样称为分层随机抽样,所得的样本称为分层随机抽样。(2)分层抽样的特点可以同时估计子群体的参数。依靠行政组织便于组织实施,根据各层的不同特点可以采用不同的抽样方法。它可以使样本在整个人群中

7、分布更加均匀,从而具有更好的代表性。提高参数估计的准确性。(3)每一层中样本大小的分布给出总样本大小n。相等分配(Equal allocation),即从每一层中获取的样本量为ni=n/i.其中:n个样本。主要是为了方便管理,成本和时间可以平衡。分层比例抽样分层比例抽样根据每一层人口中调查单位数量的比例分配样本量。公式是镍的I层中测量单位的数量。当每一层中的测量单元Ni的数量已知并且其它信息稀缺时,经常使用这种分配方案。这样,经常可以获得具有良好精度的估计,并且可以大大简化数据的分析和处理。分层最优分配分层最优抽样又称为非比例抽样,它不仅根据种群中各层的比例分配样本数,还根据各层样本的标准差调

8、整各层样本数的抽样方法。最低成本抽样、分层比例抽样和最优抽样侧重于调查结果的统计效果,而最低成本抽样在考虑统计效果的前提下,根据费用确定各级抽样的样本数量。多层抽样多层抽样法是指对调查人群进行两次或两次以上分层的分层抽样方法。采用这种抽样方法,在调查母公司被分层后,调查子母公司被分层,最后,抽样仍然采用简单的随机抽样方法。为了了解分层抽样对提高估计精度的好处,本文以某地区2009年企业出口数据中截取的904家企业为整体,说明分层抽样和样本分布的一些情况。该指标为2009年企业出口金额Y,这904家企业的最大出口值为5000(单位为1万美元,下同),最小值为50万,平均值Y=608.09第一层:

9、2600Y5000,40家企业,层内平均值y1=35.034万,层内方差第三层:700 Y,1400,115家企业,层内平均值为Y3=1036.38万,层内方差为S32=34141.69。第四层:250 y700,226家企业,平均值y4=4,193,100,方差S42=16565.56。第五层:50y内250,449家企业,平均值y5=1,232,600,方差S52=3110.05。为了保证分层后的调查结果更好,一般应注意以下几点:第一,分层是以构成调查内容的核心项目和密切相关的项目为基础的。例如,在调查服装消费时,可以根据年龄进行分层,因为服装消费与年龄密切相关,这是一个密切相关的调查项目

10、。第二,以公认的边界明确的客观依据为分层标准。如:地区、职业、教育水平等。第三,分层后,调查子母应在一定标准下保持同质性,在不同层之间保持异质性。第四,分层后,我们还需要采用简单的随机抽样方法,最终获得调查样本。5.2.3整群抽样,也称整群抽样和分组抽样,是将整体中的所有单位分成若干组(组),然后从组(组)中随机抽取一些组(组),并对所选组(组)中的所有单位进行充分调查的一种抽样组织形式。一般来说,如果组与组之间的差异很小,或者不适合单独选择调查样本,可以使用这种方法。特点:第一,不需要指定采样帧。其次,由于被调查的样本单位相对集中,便于调查,节省时间和差旅费。当使用聚类抽样时,当聚类的大小(

11、包含在聚类中的小单元的数量)接近时,通常使用简单随机抽样来提取聚类;当组的大小非常不同时,不相等概率抽样(根据与组的大小成比例的概率进行抽样)更常用于提高效率。比较分层随机抽样和整群随机抽样。5.2.4系统取样,(1)系统取样也称为机械取样和等距取样。这是一种抽样方法,按照一定的标准将整个人口按一定的顺序排列,并按照固定的顺序和间距抽取一定的调查单位。等距采样的本质是随机或非随机的,主要取决于第一个样本是如何提取的。(2)系统采样的优缺点系统采样最突出的优点是简单易行。抽样框架的要求很简单,只要求整体单元按一定的顺序(自然顺序、人为顺序和想象顺序)排列,不一定要按照具体的花名册或清单。系统抽样

12、的误差与整体单元的排列顺序有关。一般来说,系统抽样使抽样单位在整个人口中均匀分布,其估计量的方差小于简单随机抽样的方差。局限性对于一般的直线等距抽样,当使用Nnk时,样本均值作为总体均值的估计值不是无偏的。(3)系统抽样方法线性等距抽样。假设总单位为N,待提取的样本容量为N,然后计算间距K=N/n,这也称为采样距离;从1K中随机选择一个数字,并将其设置为I,然后第I个单位将是一个绘图单位,然后每K个单位将是一个绘图单位,即K,i 2K,直到画出N个数字。对称等距采样。当n为偶数时,应从n个单位中提取n个样本单位。首先,将总共n个单元分成n/2组,使得每组包含2K个单元,然后在1K中随机确定采样

13、位置,并根据以下公式从每组中提取与该组两端距离相等的两个单元。当n为奇数时,仍使用上述公式,但j直到达到(n-1)/2-1时才使用,并在终端附近增加一个采样单元:i (n-1)K,循环等距采样。当n是有限总体并且n不能被n整除时,也就是说,k不是整数,那么k只能取一个相对接近的整数,然后用线性系统采样可能会引起误差。采用圆形系统的抽样方法,将整个种群排列成首尾相连的圆形,用同样的方法确定区间k,k可以取最近的整数,在1N内抽取一个随机的起点,然后用该方法进行抽样由于循环等距采样比较麻烦,为了解决NnK中线性等距采样带来的偏差,可以在采样时稍加修改。方法是取1N的随机数,除以采样间隔K,余数作为

14、起点。虽然可能抽取的样本数量与线性等距抽样的数量相同,但每个单位被抽取的概率是不同的。子抽样法如果母亲总数太大,抽样单位分布很广,就需要采用子抽样法。多阶段抽样,也称为多阶段抽样或多阶段抽样,是一种将整个人口的抽样过程分为两个或两个以上阶段的抽样方法。当整体中有大量的单个单元,但它们之间的差异不太大时,整体单元按一定的标志分为若干组作为第一阶段的抽样单元,并根据随机性原则,选择若干组作为第一阶段的抽样单元;然后,将第一阶段的样品分成几个小组作为第二阶段的取样单位,从中选择几个小组作为第二阶段的样品,依此类推,可以有第三和第四阶段,直到满足需要。在最后阶段提取的样本单元的集合是最终的整体样本。多

15、级采样误差大。采样阶段越多,采样误差越大。注意避免不必要的分割。5.3非概率抽样技术,非概率抽样也称为非随机抽样,它不是基于被调查人群中的每个单位都同样可能被抽样的原则,而是研究者根据自己的主观判断选择抽样。非随机抽样包括随机抽样、判断抽样、定额抽样等具体方法。5.3.1任意抽样(危险抽样),也称为便利抽样,是根据调查者的便利程度进行抽样的一种抽样方法。“街道拦截法”是在街道或路口随机发现一名行人,并将其作为被调查人进行调查。“空间抽样法”是从空间的不同方向和方位对某一人群进行抽样调查。任意采样简单易行,能及时获得所需信息,省时、省力、省钱。然而,抽样偏差较大,一般用于非正式的探索性调查。只有

16、当调查单位之间差别不大时,抽样样本才具有高度代表性。判断抽样判断抽样也称为目的抽样、主观抽样和故意抽样。这是一种抽样方法,调查人员根据调查的目的和他们自己的主观经验和知识从全体人口中选择有代表性的样本。“判断”:是对整体的判断;二是判断样本的代表性。配额抽样(1)配额抽样的概念配额抽样也称为配额抽样。它是指根据市场调查对象总体单位的某些特征,将人口划分为若干类别,按一定比例分配每个类别的样本单位数量,并根据每个类别的数量任意或主观抽取样本单位。配额抽样是最常用的非概率抽样方法之一。定额抽样方法简单可行。这种方法有一定的假设,即假设具有某些相似特征的被调查者的行为、态度和反应基本相同。配额抽样和分层抽样的比较配额抽样和分层抽样将研究对象群体细分为几个子群体,然后将样本总数分配给每个子群体。根据属性特征对群体中的所有单元进行分类和区分,并根据不同的原则选择每个子群体中样本的基本单元。分层是指按照随机原则分层抽样,而配额抽样是指主观判断配额内选定的样本。配额

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论