版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、规模以下工业抽样调查实施方案调查目的反映规模以下工业的基本总量,为国民经济核算提供基础数据。调查范围( 总体 )年产品销售收入500 万元以下的非国有工业企业和全部个体经营工业单位。具体包括,调查年份年初在册的年产品销售收入500 万元以下的非国有工业企业、全部个体经营工业单位以及当年新建的年产品销售收入500 万元以下的非国有工业企业和新增的全部个体经营工业单位。调查内容及表式调查内容包括500 万元以下的非国有工业企业的基本情况,如:企业详细名称、地址、企业法人代码、登记注册类型、人员及生产经营状况等;个体经营工业单位的基本情况、人员及生产经营状况等。调查分为年报和定期两种。定期报表包括1
2、 至 3 月份、 1 至 5 月份和 1 至 9 月份调查,其中,1 至 3 月份和 1 至 9 月份调查为部分样本单位调查。年报和定期中的部分样本单位调查的主要内容包括总量结构和企业单位数指标;定期中的1 至 5 月份调查的主要内容为基本总量和企业单位数等指标。调查表分为基层表和综合表两种,具体内容详见表式。调查报告期及报送时间年报的报告期为1 至 11 月份,报送时间为2001 年 12 月 25 日前;定期报表中的1 至 5 月份调查的报告期为1 至 5 月份,上报时间为2002 年 6 月 25 日前;部分样本单位调查的报告期分别为 1 至 3 月份和 1 至 9 月份,报送时间为当年
3、4 月 8 日和 10 月 15 日前。各省(自治区、直辖市)企业调查队要将调查数据( 基层表 ) 、推算数据( 综合表) 和抽样框、样本以及抽样过程中涉及的资料等报送国家统计局企业调查总队。报送方式为计算机远程传输。调查总体划分根据国民经济核算要求,首先将规模以下工业总体划分成两个子总体,即年销售收入500 万元以下的非国有工业企业,以下简称企业子总体;全部个体经营工业单位,以下简称个体经营单位子总体。根据调查总体的分布状况、抽样框现状以及我国目前行政管理体制特点,各地的抽样调查设计可以将企业子总体再划分成两个子总体,即乡及乡以上年销售收入500 万元以下的非国有工业企业,以下简称乡及乡以上
4、企业;销售收入500 万元以下的村及村以下工业企业,以下简称村及村以下企业。同样可以将个体经营单位划分成农村个体经营工业单位和城镇个体经营工业单位两个子总体。需要强调的是,对两个子总体的进一步划分的主要目的,是为了适应各种不同的抽样框,并非要求得到各子总体的数据。各地可以根据本地区抽样框的条件,采取不同的方法划分子总体,但要求能区分出企业和个体经营单位两种类型。六、 基本抽样方法 基本原则是,对调查总体中有企业名录库的部分采用目录抽样,没有企业名录库的部分采用整群抽样。若抽样框条件许可,应对所有规模以下工业企业采用目录抽样,对个体经营单位采用整群抽样。目前,考虑到各地企业名录库的状况及上述四个
5、子总体的分布特点,方案设计了四种抽样方法,供各地选择使用:(一)一阶段目录抽样。根据省级企业名录库直接抽取样本企业,有名录库的企业都应采取此 方法。(二)一阶段整群抽样。在省一级直接抽取行政村,以村、街道或居委会作为群单位。主要用 于农村和城镇个体经营单位和未建企业名录库的村及村以下企业。(三)二阶段整群抽样。第一阶段抽取省辖区内的市辖区、县级市和县(以下简称县、区),第二阶段抽取样本县、区内的行政村,以村作为群单位。主要用于农村个体经营单位。村及村以下 企业若无名录库,也可以采取此方法。根据各地情况,有条件的省(市、区)也可对城镇个体经营单位采用以街道或居委会为群单位的整群抽样。(四)二阶段
6、目录抽样。第一阶段抽取省辖区内的县、区,第二阶段抽取样本县、区内的个体 经营单位。主要用于城镇个体经营单位。七、总体估计量及其方差方案根据不同的子总体,设计了不同的抽样方法。因此,在进行估计时,要先对子总体进行 估计,然后估计总体。总体总量指标估计量与子总体总量指标估计量的关系及方差如下: 4(一)总体总量指标估计量: Y? = z Y k 1 4(二)Y?的方差估计量:v(Y?) = v(Y?k)k=1(三)Y?的最大相对误差:r =啜Y?式中,k( = 1,2,3,4)代表不同子总体,k = 1表本乡及乡以上企业子总体,k = 2表本村及村以下企业子总体,k =3表示农村个体经营单位子总体
7、,k = 4表示城镇个体经营单位子总体。由于本方案规定的概率度为 95%,故t等于1.96 ,以下相同。Y?为总体总量指标 Y的估计量,v(Y? 为Y?的方差估计量。Yk为第k个子总体的总量指标 Yk的估计量,v(Y?)为Yk的方差估计量。r为 总体总量估计量Y?的最大相对误差。有关各子总体的抽样方法及估计量计算方法在以下有关部分 进行说明。八、抽样精度规模以下工业抽样调查以省为总体控制抽样精度,具体要求是:在95%的概率保证程度下,各省(区、市)的核心指标一一工业总产值的最大相对误差控制在10%以内,即r 10% o同时,要求全省(区、市)规模以下工业总体的企业单位数指标的最大相对误差控制在
8、15%以内,即r 15%。抽样精度是以全部年销售收入500万元以下的非国有工业企业和个体经营工业单位作为一个总体设置的,即要求总体工业总产值估计值的最大相对误差不超过10%,并非要求每个子总体工业总产值的最大相误差控制都在10%以内。各子总体的抽样精度 rk与总体抽样精度r的关系为:式中,Y为总体总量指标值, 丫卜为第k个子总体的总量指标值,r为总体总量指标估计值的 最大相对误差,鼠为第k个子总体的总量指标估计值的最大相对误差。例,若四个子总体的总量相等且取r1 = r2= r3 = r4 = r,则可得到:r2 =(1/4)2*(r12 r22 r32 r42) =(1/4)* r 2由于r
9、 =10% ,所以r = 20% ,即四个子总体的工业总产值总量指标的最大相对误差都控制 在20%A内即可。再例,若四个子总体的总量占抽样总体总量的比重分别为:乡及乡以上企业占1/4 ,村及村以下企业占1/2 ,农村个体经营单位占 1/5 ,城镇个体经营单位占 1/20 ,则有:r2 =(1/4)2/ (1/2)222 (1/5)232 (1 /20)242公式中,满足r=10%的r1、上、r3和Q的取值有许多种组合。比如,分别取值16% 12%20%F口 25% 计算得r =8.5%,可满足方案r工10%勺要求。确定鼠的目的是为了分别计算各子总体的样本量,各地应利用有关资料及本地区的实际情况
10、测算并确定。不同子总体的最大相对误差可以相等,也可不相等,但彼此之间的差异不宜过大。一般原则是,占总体总量比重大的子总体,rk应相对较小,即控制的抽样精度较高;占总体总量比重小的子总体,rk应相对较大。调查设计共分为4个部分,主要是针对不同的子总体及抽样框采取了不同的抽样设计。第一 部分为一阶段目录抽样,第二部分为二阶段整群抽样,第三部分为二阶段目录抽样,第四部分为 一阶段整群抽样。第一部分一阶段目录抽样乡及乡以上工业企业抽样设计本部分的应用范围是所有有名录库的规模以下工业企业。无论是乡及乡以上或是村及村以下 工业企业,只要有省一级企业名录库,都应采用此方法。考虑到目前各地普遍已建立乡及乡以上
11、 工业企业名录库,因此本部分以乡及乡以上工业企业为例说明此方法。已建立村及村以下工业企 业名录库的省(区、市)应对村及村以下工业企业采用此方法。本部分方法要求从省级企业名录库 中直接抽取企业。在本部分 k取值1,代表乡及乡以上企业子总体。一、抽样框抽样框的范围包括全部年销售收入500万元以下的乡及乡以上的非国有工业企业,企业年销售收入以上年数据为准,即包括上年末销售收入不足500万元的所有乡及乡以上的非国有工业企业。抽样框内容应包括企业的基本属性指标和基本价值量指标。由于抽样框中资料的时点与调查时点存在差异,各省(区、市)在调查时会遇到企业的消亡和新生的问题。企业消亡是指企业被列入抽样框,但在
12、调查时已不存在,如破产、解体或改行;新 生企业是指企业没有列入抽样框,但在调查时已经产生,如新建企业或由其他行业改行而来的企 业。因此,必须对新生企业和消亡企业进行相应的处理。具体处理办法将在有关部分进行说明。二、企业分层将子总体中的全部企业按规模工业总产值或销售收入进行分层。各地可灵活掌握分层数量和分层界限,一般分为 2或3个层即可。三、样本量的确定与分配(一)样本量计算公式:nk N N kh Skhh =1其中:SkhN khN kh -1 i mNkhYkhiT为子总体内的分层总数。Yk为子总体的工业总产值,L是样本企业总数,S2h式中,h代表层(h = 1,2,H ) , HYkhi
13、为第h层第i个企业的工业总产值,Nkh是第h层的企业单位总数,是第h层企业工业总产彳1指标的方差 ,rk为最大相对误差。按上述公式计算得到样本量,只是理论值。在实际调查时会遇到企业消亡问题。例如,样本 抽到了某企业而该企业已经不存在或已改行,实际样本会因而减少。为此,需要事先对计算得到 的样本量进行调整。调整方法是预先对消亡企业的比例进行大致的估计,并据此放大样本量。例 如,估at约有10%的企业消亡,则在计算得出样本量的基础上增加10%。消亡企业的比例,可依靠经验进行判断。(二)分配样本。将上面计算得出的并经过调整的样本企业总数叫,采用奈曼分配方法进行分 配。第h层所需的样本量nkh的计算公
14、式为:N kh Skhnkh = nk -H二.N kh Skhh 1四、样本抽取的方法层内抽取样本主要有两种方法,即对称等距抽样法和简单随机抽样法。各地可根据具体情况,选用其中的一种方法。(一)对称等距抽样.将层内企业按工业总产值数额由大到小排队、编号。.计算每层的抽选组距 Kh: Kh=Nh。nkh.当层内样本量nkh为偶数时,先将层内Nkh个企业分为(no/2)个组,使得每组包含2Kh个单位,然后在第1到第Kh个企业中随机地确定抽样起点i ,按下面的公式在每组中抽取距该组两端等距离的两个单位:i+2jKh,2(j +1)Kh i+1 j =0,1,(nh/2)1.当nkh为奇数时,仍按上
15、式进行,但 j取到nk;1 -1为止,并要增加靠近终端的一个样本 单位:i +(Mh 1)Kh。当层的抽样比 加=口比0.33时,应采用简单随机抽样法抽取样本。Nkh(二)简单随机抽样将层内所有企业按自然顺序从1到Nkh进行编码,然后根据随机数表抽取样本,一直抽到A,个样本单位为止。五、估计量在进行估计时,同样需要注意企业的消亡问题。例如,第 h层的样本量为100个企业,而在 调查中发现有10个企业已不存在,实际只调查了90个企业。这意味着抽样框中的企业数量发生了变化,因此需要进行调整。 调整的方法是根据实际调查中样本企业的消亡比例,调整企业总数。仍采用上例,并假定在抽样框中该层共有 1000
16、个企业。由于该层的样本中有 10% (=10/100) 的企业已不存在,相应的要将该层的企业总数由原来的1000调整为900(= 1000 10/100%1000)。计算该层的估计量时,样本量 nkh为90,层内企业总数 N,为900。进行上述调整的前提是企业确实消亡或不存在了。如果企业仍存在,但因某种原因没有回答,则不应做上述调整。以下计算各种估计量时,所用的样本量nk和nkh都是实际调查的样本企业数,企业总数Nk和Nkh都是经过调整后的企业数。HHN nkh(一)子总体总量指标估计量:因= Ykh =Ykhihh= nkh i =1式中,Ykhi为第h层第i个样本企业的有关指标值。这里还需
17、要注意处理新生企业问题。处理办法是尽可能找到新生企业的名录,将新生企业视 为一个独立的层,从中抽取一个小样本进行调查,据此计算该层的各种指标及其方差,并将结果增加到子总体的相应估计量中。此时,层总数变为 他层相同。H +1 ,新生企业层的各种估计量的计算与其H(二)Y?的方差估计量:v(Yk)=z Nkh(Nkh h 12 skh - nkh)nkh其中:n kh2 工skh = r r (nkh 1) i 1(Ykhi -Ykh);nkh一、Ykhi nkh i 1(三)Y?的最大相对误差:rkt,v(Yk)六、有关标记注释(二)Nk为企业单位总数,(一)h代表层(h = 1,2,,H )
18、, H为分层总数。i企业单位编号,表示第i个企业单位。Nkh为第h层的企业单位总数,nk为样本企业单位总数,nkh为Hnk = Z nkh hd第h层样本企业单位总数: HNk = Z Nkh ;h 1(三)K为子总体的总量指标值,Yk为其估计量。Ykh为第h层的总量指标值,Yt为其估计量。Ykhi为第h层第i个企业的指标值。(四)v(Yk)为Yk的估计方差。Skh是第h层企业指标值间的方差,s2h为第h层的样本方差。rk为最大相对误差。第二部分二阶段整群抽样村及村以下工业企业单位抽样设计本部分的应用范围主要是农村个体经营单位。若村及村以下企业尚无名录库,也可采用此方法。本部分以村及村以下企业
19、和农村个体经营单位为例进行说明。在本方法中,第一阶段从省内 抽取有行政村的县、 区,第二阶段从抽中的县、 区中抽取行政村,以行政村作为群单位。 本部分k 取彳1 2和3, k = 2代表村及村以下企业子总体,k = 3代表农村个体经营单位子总体。一、建立抽样框(一)一级抽样框一级抽样框由省内所有有行政村的县、区组成,县、区统称为一级单位。在本部分,第二阶 段抽样单位为行政村,因此不含行政村的县、区不包括在抽样框内。建立一级抽样框,要求至少 要掌握分县、区的村及村以下企业的工业总产值资料,用于一级单位分层。(二)二级抽样框二级抽样框由一级样本单位中的所有行政村组成。需要掌握样本县、区中所有行政村
20、的一些基本数据,包括每个行政村中的工业企业数和个体经营单位数。建立二级抽样框, 需要对样本县、区进行预先清查。通过清查,可以获得较为准确的一级样本单位及其各行政村的企业数和个体经 营单位数。清查的目的有两个:一是为抽取样本村提供依据。同时,有效地利用清查数据作为抽 取样本的辅助信息还可以减少样本量。二是用于计算一级样本单位的总量指标。由于本部分在一 级样本单位内采用的是比率估计量,因此,企业单位数的准确与否直接关系到总量指标估计的准 确性。二、一级单位分层在进行一级单位分层之前,应比较本省(市、区)的村及村以下企业与农村个体经营单位的 规模和方差,选择其中规模大、方差大的子总体的总产值作为分层
21、标识。下面以选择村及村以下 企业的总产值为分层标识为例进行说明。进行一级单位分层,首先需要将所有一级单位按其村及村以下企业工业总产值从大到小排 序,并按下述方法进行分层:第一步,按顺序逐个累加组合成一系列新的总体,即:由第一个一级单位组成第一个总体, 第一和第二个一级单位组成第二个总体,第一、第二和第三个一级单位组成第三个总体,第一、 第二、第三和第四个一级单位又组成第四个总体,依此类推,如果有100个一级单位就可组合成100个新总体。Yki ,则第M个总体的平均第二步,计算每个新总体的平均数、方差和变异系数。设第 M个总体(即由第1至第M个 一级单位组成的总体)中的第i个一级单位的村及村以下
22、企业总产值为 数、方差和变异系数的计算如下:(一)平均数:1 MZ Yki( i =1,2,M ; k =2)M i4(二)方差:(三)变异系数:CkMYkM第三步,观察各新总体的变异系数。这时,各新总体的变异系数一般会呈现逐渐上升的趋势, 分两种情况:第一种情况,最初(从第二个总体的变异系数起,第一个总体只有一个单位,方差为 0)若干个的变异系数小于 0.15(非精确值);第二种情况,最初的变异系数就很大,大于 0.15。在第一种情况下,以变异系数为0.15左右作为分层点,组合出第一个层。例如,当前 M个一级单位组成的总体的变异系数为0.156时,则将这M个一级单位作为一个层。 这样就得到了
23、第一个层。确定第二个层的方法是将第一个层的单位剔除,然后对剩余的一级单位重复第一步和第 二步,并以0.15作为分层点,划分出第二个层。重复此过程,可以组合出第三、第四层,。采用此方法只需分出 3或4个层即可,剩余的所有一级单位都归为最后一个层。此层单位数多且变异系数较大,但总量比重小,对总体影响不大。在第二种情况下,由于最初的变异系数就大于0.15 ,无法按上述方法进行。此时,应将第一个一级单位剔除出去,然后重复执行第一步和第二步;若最初的变异系数仍大于0.15 ,再在剩余的一级单位中剔除第一个一级单位。重复此操作,直至在剩余的一级单位总体中出现第一种情 况。此时,以所有剔除出的一级单位组成第
24、一个层,并对其余的一级单位按第一种情况的模式进 行分层。三、样本量计算与分配(一)确定各阶段的抽样精度为了分别计算各阶段的样本量,需要对总的抽样精度进行分解。各阶段最大抽样误差与总的 最大相对误差之间关系为:22,2限=1 +式中,k(k =2)为全省村及村以下企业总产值估计量的最大相对误差,5为第一阶段抽样的最大相对误差,rn为第二阶段抽样的最大相对误差。上述等式关系表明,若取较大的 J ,则相对较小,意味着一级样本量较小,而二级样本量增大。反之,若取较小的J ,则相对较大,意味着一级样本量较大,而二级样本量减少。之和不大具体操作时,要先确定 rk的取值范围,然后确定 j和睦的取值,必须保证
25、 r2与r2(二)计算和分配一级样本.计算一级样本量。以一级单位的村及村以下企业总产值及其方差为依据来计算一级样本 量,采用奈曼方法分配,故有:住 ALSkL IL =1ac2kL其中:S2LAlAlAl - 1 i =1YkLi - ZI Al /式中,角标L表示一级单位分层。在村及村以下部分,一级单位共分为G个层。k取值2。Al是Yk为全省村及村以下企业总产值,YkLi为第L层第i个一级单位的村及村以下企业总产值,第L层一级单位总数,ac是一级样本单位总数,SL是第L层一级单位村及村以下企业总产值指标之间的方差。需要注意,上面的分层和计算样本量只考虑了村及村以下企业的分布,各省在计算样本量
26、时,应同时利用农村个体经营单位总产值数据测算一下一级样本需要量。计算方法是将上面计算公式 中的村及村以下企业总产值改用农村个体经营单位的有关数据。如果后者需要量较大,应适当增 加一些样本单位。此外,由于计算样本量所依据的数据存在时间上的误差,因此应对计算所得样 本量作适当调整,调整方法是在计算所得样本量基础上增大10%。.分配一级样本。将上面求得的一级样本总数 ac,采用奈曼分配方法进行分配, 第L个一级单位层所需的样本量 aL为:ALSkL aL 二 ac -G AL SkLL 1按此公式计算的某层一级样本单位数可能会大于该层一级单位数,假定第一个层(即L = 1时)出现此种情况,即:a a
27、 A1。此时,该层的所有单位都须入选样本,而对于其他层,上面的 公式应有所变化。仍假定第一个层的所有一级单位全部入选样本,则计算其余各层样本量的公式为:aL=ac A1.二.ALSkLL 2另外,在每个层抽取的一级样本单位数须大于1,这是为了便于计算方差。若计算出某层级样本单位数为1,则需在该层增加一个一级样本单位。(三)计算和分配二级样本1.计算二级样本量:bk =aLG Al :L2一 BkLi BkLi SkLiL 4 iL aL i 4tL 3 aL i =1BkLi S2kLi其中:1BkLi_SkLiN kLij (YkLij -YkLi)(BkLi - 1) j若无法计算skLi
28、,可用样本数据计算或利用其他数据推算。式中,bk为估计第k个子总体指标所需全省样本村数; G为一级单位分层数;BkLi为第L层 第i个一级样本单位中有第 k个子总体企业单位的村数; Al为第L层一级单位数;aL为第L层 一级样本单位数;Yu为第L层第i个一级样本单位中第 k个子总体的企业平均指标; YkLj为第L 层第i个一级样本县、区单位中第 j个村第k个子总体的企业平均指标。计算出的样本量只是最小样本量,为了保证预期的抽样精度,各地应在计算出的样本量的基础上 适当进行追加,如增加 5%。2.分配二级样本。将上面求出的两个样本村数bk ( k = 2,3)分别按比例分配给各一级样本单位,分配
29、给第L层第i个一级样本单位的第 k个子总体的样本村数(bkLi)为:八bkBkLibkLi - g aL.一 一 BkLiL 3 i5式中,分母为所有一级样本单位中有第k个子总体的企业单位的村数;BkLi为第L层第i个样本县、区中有第 k子总体的企业单位的村数。四、抽取样本(一)抽取一级样本单位在一级单位分层的基础上,每个层内按县、区的村及村以下企业工业总产值排队,采用等距 抽样方法抽取一级样本单位。(二)抽取样本村确定了每个一级样本单位中的样本村数后,在各一级样本单位中分别独立地抽取样本村。在一级样本单位中抽取样本村时需要分别分析各一级样本单位中行政村的分布情况,若各村规模(工业总产值或企业
30、数)的差异相对较小,则可直接采用按村工业总产值或企业数排队等距抽取样本 村;若各村的规模差异很大,有必要进行一些处理。处理方法如下:.对个别特别大的村单独进行调查,对其余的村按工业总产值或企业数排队采用等距方法抽取样本村。若一级样本单位中,个别村的规模特别大,而其余村相对差异较小,此方法比较适用。.对村进行分层,按比例将样本村分配到各层, 各层按村工业总产值或企业数排队采用等距方法抽取样本村。若一级样本单位中,村间差异很大,且各种规模的村都较多,此方法比较适用。由于在每个一级样本单位中,既要抽取用于估计村及村以下企业总量指标的样本村,又要抽估计农村个体经营单位总量指标的样本村,若完全独立地抽取
31、两种样本村,无疑会增大样本村的 数量。为此,本部分采用等概率的交叉抽取样本村的方法。具体步骤如下:首先,采用上述方法抽取用于估计村及村以下企业总量指标的样本村(b2Li )。第L层第i个一级样本单位中所有有估计村及村以下企业的村总数为B2Li ,抽取的样本村数为b2Li。其次,抽取用于农村个体经营单位总量指标的样本村(b3Li)。将第i个一级样本单位中所有有个体经营单位的村(B3Li)分解为两类,一是含有村及村以下企业的村(B;Li );二是不含村及村以下企业的村(B:)。抽取过程如下:1.在B3Li个村中抽取b3Li个样本村,实现的方法是在已抽取的用于估计村及村以下企业子总体的b2Li个样本
32、村中抽取:b3Li = b2Li 用B3Li2.在B2个村中抽取b3Li个样本村:b3Li =3 FL交叉抽取样本村的优点是使不同的子总体共享样本村,减少样本村总数。五、估计量(一)估计第k( k=2,3)个子总体的总量指标及其方差本小节的估计量用于估计除企业数外的各种总量指标及其方差,有关企业数的估计将在下节讨论。.子总体总量指标估计量:YkY?LL 4A aL 其中: aL i 1式中,Yk为全省第k个子总体的有关总量指标估计量;汽为第L层第k个子总体的总量指标估计量;YkLi为第L层第i个一级样本单位第k个子总体的总量指标估计量, 其计算公式可一般 地表述为:bkLi YkLijYLi
33、= YkLiON kLi YkLi 二 N kLij . j 1式中,右边第一项(丫如0)为第i个一级样本单位中需单独调查村的相应总量指标;第二项为抽样部分的估计量,在计算时应注意,需要在 NkLi中剔除相应的单独调查部分。若无单独调查部分,则YkLi0项为零。计算一级单位总量 YkLi时应注意式中的企业单位总数NkLi。若NkLi为非清查所得,应注意对其进行调整。调整的方法可参见第一部分的有关内容,或根据调查的实际数据对已有数据进行 比例调整。否则, NkLi的误差会导致估计量 YkLi的偏差增大。此外,若在一级样本单位内按村的规模进行了分层,应分别对各层按此公式计算,得到各层总量,然后对层
34、总量求和,得到该一级样本单位的总量。YkLij为第L层第i个样本县、区第j个村第k个子总体的总量指标:NkLijYkLij = YkLijhh =1KLjh为第L层第i个一级样本单位第j个样本村第k个子总体第h个企业的总量指标。NkLi为第L层第i个一级样本单位第k个子总体的企业数,数据来源下节讨论。NkLij.为第L层第i个一级样本单位第j个样本村中第k个子总体的企业数。G. Yk的方差估计量:v(Yk) = v(YkL)L=1式中,v(Yk)为全省第k个子总体的总量指标 Yk的估计方差,v(Y?L)为第L层总量指标Y?l的方差估计量,v(YL)为第L层第i个一级样本单位总量指标YkLi的方
35、差估计量:2 2,、2l八 a lv)=/AL = 1-OL z 院-YL)2+&z v(YL)aL(aL -1) Ial/自aL y丫鼠)三人 /BkLi八 1 鲁占Li N2Lj (YkLj -C)2bkLi(bkLi T) IBkLi j计算v(YL)时应注意与前面计算 YL的方法相互一致,在存在单独调查的村时,此公式只是?,、一抽样部分的方差(单独调查部分没有抽样误差 ),式中的BkLi都不应包含单独调查的村,YkLi也应是 抽样部分的企业平均指标,即:bkLi.-YkLijYkLij mbkLi- N kLij .?注意,YkLi在这里只是第不包括单独调查村中的企业,j 1L层第i个
36、一级样本单位中第 k个子总体抽样部分的企业平均指标,今I 、, 一,r ,1 一人,因此YkLi并非该样本县的企业平均指标估计量。第L层第i个一级样kLi本单位中第k个子总体的企业平均指标的计算公式为:Y?二 丫 kLi 一YLN kLi? 一 与当不存在单独调查部分时,丫屋与YkLi相等。此外,若在一级样本单位内按村规模进行了分层,应分别对各层按此公式进行计算,然后进 行求和,得到该一级样本单位的方差。YL为第L层第i个样本县、区第j个样本村第k个子总体企业平均指标: kLijYkLij=YkLijN kLij h 1NkLijYkLijhYkLijh为第L层第i个样本县、区第j个样本村第h
37、个企业的指标值;N kLij为第L层第i个一级样本单位第j个样本村中第k个子总体的企业单位数。3.子总体的企业平均指标估计量:Yk上 k Nk式中,Nk为第k个子总体的企业单位总数。根据方案要求,N kLi为清查所得或通过样本数 kLi据调整得到。因此,Nk必须依据NkLi进行估计,具体估计方法见下一小节。Y的最大相对误差:rk =独立kkYk(二)估计第k ( k = 2,3)个子总体的企业单位数本小节的估计量用于估计全省村及村以下企业子总体和农村个体经营单位子总体的企业单 位数及其方差。估计方法分为两种:其一,利用一级样本单位清查数据进行估计,清查数据质量 较好时应采用本方法。其二,利用样
38、本村的调查数据进行估计。.利用清查数据估计企业单位数。此时,各一级单位被作为群单位,清查是对样本群的全面 调查,因而抽样过程实际上是以县、区为群单位、以村为最小抽样单位的单级整群抽样。G A aL (1)子总体的企业单位总数估计量:N?k =2 NkLiLW aL i =1N?的方差估计量: ka,aL1 - ( (NkLiAL i +-Kl)2其中:N?kL1aLaLkLi(3) N?k的最大相对误差:rN雪。k N?kNkLi为清查得到的第 L层第i个县、区中第k个子总体的企业单位总数。2.利用样本村数据估计企业单位数。此时,一级单位仍为县、区,一级单位中以村为最小抽 样单位,将企业数视为
39、村的一个指标,因而抽样过程实际上是以县、区为一级抽样单位、以村为 最小抽样单位的二阶段抽样。G(1)子总体的企业单位总数估计量:N?kN?kLkkLL4式中,N?k为全省第k个子总体的企业单位数估计量,N?kL为第L层第k个子总体的企业单位数估计量,N?kLi为第L层第i个一级样本单位第 k个子总体的企业单位数估计量:a LbkLiN?kL =工 N?kLi;N?kLi =心口0+/ NkLijaL i 1bkLi j dNkLi0为第i个一级样本单位中需单独调查村中的企业单位数,而且需要在BkLi中剔除需要单独调 查的村数,若无此划分,则NkLi0项为零。NkLij为第L层第i个一级样本单位
40、第j个样本村中第k 个子总体的企业单位数。此外,若在一级样本单位内按村的规模分层,应分别对各层按此公式进行计算,得到各层总量, 然后对各层总量求和,得到该一级样本单位的总量。GN?k的方差估计量:v(N?k)=ev(N?kL) L衽式中,v(N?k)为企业单位总数 N?k的估计方差,v(N?kL)为第l层企业单位总数 N?kL的估计方差,v( N?kLi)为第L层第i个一级样本单位企业单位总数N?kLi的估计方差:v(N?kL)=/Al 八 1一乎七(N?kLi NL)2+&L v(N?kLi)aL(aL -1) Al aL 1V(N?kLi ) = - 1 皿甘(NkLij N?kLi )2
41、 kLi /, C kLij kLi /bkLi (bkLi -1) I BkLi Ji =t与计算v(YL)时一样,在存在单独调查的村时,v(N?kLi)只用于计算抽样部分的方差,且在一级样本单位内进行了分层时,应分别对各层按此公式进行计算,然后进行求和。N?k最大相对误差:rN =3)kN?k六、本部分主要符号索引(一)角标L表示不同的一级单位层(L=1,2,,G),本部分共分G个层。角标i表明不同的 一级单位。角标j表明不同的二级单位(村)。角标h表明不同的企业单位。(二)A为省内全部一级单位总数,Ac为省内全部有行政村的一级单位总数,AL为第L层一级单位总数,ac为省内全部一级样本单位
42、总数,aL为第L个层一级样本单位数。(三)B为全省全部行政村总数, Bk为有第k种工业的村总数,BkLi为第L层第i个一级样本 单位中有第k种工业的村数,bk为第k个子总体的样本村数;bkLi为第L层第i个一级样本单位中 第k个子总体的样本村数。(四)Nk为第k个子总体的企业单位总数,NkL为第L层第k个子总体的企业单位数,N kLi为第L层第i个一级样本单位中第 k个子总体的企业单位数,NkLij为第L层第i个一级样本单位第j个样本村中第k个子总体的企业单位数。l?k为全省第k个子总体的企业单位数估计量,N?kL为第L层第k个子总体的企业单位数估计量,N?kLi为第L层第i个一级样本单位第k
43、个子总体的企业单位数估计量,N?kLi为第L层第i个一级样本单位第k个子总体的村企业平均数估计量。(五)Yk为全省第k个子总体的总量指标值, YkL为第L层第k个子总体的总量指标值,YkLi为 第L层第i个一级样本单位第 k个子总体的总量指标值,YkLij为第L层第i个一级样本单位第j个村第k个子总体的总量指标值,丫小卜为第L层第i个一级样本单位第j个样本村第h个企业的指标值。Yk为全省第k个子总体的总量指标估计量,YkL为第L层第k个子总体的总量指标估计量,?YkLi为第L层第i个一级样本单位第 k个子总体的总量指标估计量,Yk为全省第k个子总体的企 业平均指标彳t计量, YkLi为第L层第
44、i个一级样本单位中第 k个子总体(抽样部分)的企业平均 指标,YLj为第L层第i个样本县、区第j个村第k个子总体的企业平均指标。(六)v(Yk)为全省总量指标 Yk的估计方差,v(Y?L)为第L层总量指标Y?L的估计方差,v(Y?Li) 为第L层第i个一级样本单位的总量指标Y_i的估计方差,v(N?k)为全省企业总数 N?k的估计方差,v(N?kL)为第L层企业总数 总里的估计方差,v( N?kLi)为第L层第i个一级样本单位企业总数 N?kLi的估计方差。 kLi(七)rk为全省第k个子总体总量指标的最大相对误差,心为全省第k个子总体企业单位总数K的最大相对误差。第三部分二阶段目录抽样城镇个
45、体经营单位抽样设计本部分的应用范围是城镇个体经营单位。若有条件,各地对城镇个体经营单位也可以采用以 街道为群单位的整群抽样,方法参照第二部分即可。本部分以城镇个体经营单位为例进行说明。 在本方法中,第一阶段从省内抽取县、区,第二阶段从抽中的县、区中抽取城镇个体经营单位。 本部分k取彳1 4,代表城镇个体经营单位子总体。一、建立抽样框(一)一级抽样框。一级抽样框由省辖区内所有县、区组成,一级抽样框中的各县、区统称一 级单位。一级抽样框中资料的主要内容包括个体经营单位数和工业总产值等。建立一级抽样框, 要求各省掌握全省分县、区的城镇个体经营单位工业总产值和户数资料。(二)二级抽样框。二级抽样框由一
46、级样本单位辖区内的所有城镇个体经营单位组成,其内容应包括个体经营单位的名称、地点等资料。二级抽样框资料需要通过对二级样本单位的清查工作 取得。二、一级单位分层本部分的一级单位分为两部分:第一部分为有行政村的县、区,也即村及村以下工业的全部 一级单位;第二部分为没有行政村的县、区,村及村以下工业抽样的一级抽样框不包括这部分, 但包括在本部分的抽样框内。在进行一级单位分层时,对于上述第一部分仍采用与村及村以下工业抽样设计相同的分层,即G个层;第二部分单独构成一个层,为方便表述,以下将此层称为纯城镇工业层”。本部分共分G +1个层。三、计算样本量(一)计算一级单位(县、区)样本量。本部分确定一级样本
47、的方法以村及村以下工业部分已抽取的ac个一级样本单位为基础,已抽取的ac个样本单位仍作为本部分的样本单位,同时 纯城镇工业层”的所有一级单位都入选本部分的一级样本。一般来说,纯城镇工业层”的一级单位个数较少,且对城镇个体经营工业总量的影响较大,因而其所有一级单位都入选样本。如果在一些省,纯城镇工业层”中一级单位个数较多,可考虑从中抽取部分样本单位,但这部分抽样比应高于其他层。本部分的一级样本来自村及村以下工业抽样设计,因此应根据实际数据测算出第一阶段抽样精度入。如果测算出的 建与预期的建值差距很大,则应适当调整一级单位样本量,并据第二部分给出的I和的关系式,确定rn的取值。(二)确定样本企业单
48、位数:G 1 aLG 1 A aLi2 2: NkLi 、二”. NkLiSkLiL4 i 1L 4 aL i 4nk :2FYiTiNkLiSkL t J L 3 aLi3NkL其中:SkLi-3YkLiNkLi式中,S2Li可用样本数据s2Li替代:nkLiS2Li-匕)21nkLiYli= - YkLijnkLij 1式中,YkLij为第L层第i个一级单位第j个的城镇个体经营单位的工业总产值。四、分配样本确定第L层第i个一级样本单位中城镇个体经营单位子总体的样本单位数,采用等比例分配 办法。计算公式如下:_ N kLinkLi = nk -a、N kLi i 1式中,NkLi为第L层第i
49、个一级样本单位中城镇个体经营单位总数,a为全省所有一级样本单位总数,nk为全省城镇个体经营样本企业单位数,n kLi为第L层第i个一级样本单位中的样本企业单位数,。五、抽取样本确定了每个一级样本单位中的样本企业单位数后,在各一级样本单位中分别独立地抽取样本企业单位。抽取样本企业单位时同样需要分别分析各一级样本单位中城镇个体经营单位的分布情 况,若单位间差异相对较小,则可直接采用按单位工业总产值排队等距抽样或简单随机抽样方法 抽取样本;若单位间规模差异很大,有必要在一级样本单位中按规模进行分层。六、估计量包括城镇个体经营单位子总体的总量指标估计和企业单位数指标估计。关于总量指标估计, 本部分给出
50、了两种方法,一是无偏估计量,二是比率估计量。两种方法各有利弊。由于各省具体 情况差异较大,统一规定采用某一估计量难免顾此失彼。两种估计量各省都应测算,并对结果进 行比较,以确定适合本省情况的估计量。(一)估计全省第k ( k = 4)个子总体的总量指标及其方差(无偏估计量)本方法的优点是计算方法比较简单,只需掌握一级样本单位的企业单位数资料,无需知道全省的企业单位数,然而,估计量的方差通常较大。G 1.子总体总量指标估计量:Yk = Y?lL 1其中:Y?l = AL zL Yu ; RuYkLihaL i 1nkLi j1式中,YkL为第L层第k个子总体总量指标估计量,YkLi为第L层第i个
51、一级样本单位第k个子总体总量指标估计量。此外,若在一级样本单位内按村规模做了分层,应分别对各层按此公式计算出各层的总量,然后 对各层总量求和,得到该一级样本单位的总量。G 1. Yk的方差估计量:v(Yk)= v(YkL)Lz1式中,v(Y?)为总量指标Yk的估计方差,v(YL)为第L层总量指标YkL的估计方差,v(Y_i)为第L层第i个一级样本单位总量指标YkLi的估计方差:kLiA2 尸 a aLq A aLvR)=, L 八 i -;工 Mu -%)2+Al vRi)aL (aL -1八AL JiaL iT2vRi)=N:Li 1-詈普 N kLi J n kLie 1aL1nkLif
52、C 4Y?.其中:Y?l= z YkLi;SLi=, z(YkLij-Y?Li)2 ;YkLi=-kLLaL i 1(nkLi -) j 1N kLi计算v(YkLi)时应注意与前面计算 YkLi的方法相互一致。若在一级样本单位内按村规模进行了分层,应分别对各层按此公式进行计算,然后进行求和,得到该一级样本单位的方差。? Y3.子总体企业平均指标估计量:Yk = 左N?k4. Yk的最大相对误差:rk kkt.v(Yk)(二)估计全省第k ( k = 4)个子总体的总量指标及其方差(比率估计量)本方法的优点主要是估计量的方差通常较小,但需预先掌握全省所有一级单位的企业单位数资料,也即全省第 k
53、种企业单位总数。G 1子总体总量指标估计量:Yk = Y?lL 1其中:R=NklaL、YLi 1NkLinkLiaL二 N kLi i 1“Li YkLih jW式中,Y?为全省第k个子总体的总量指标估计量,YkL为第L层的总量指标估计量,YkLi为第L层第i个一级样本单位的总量指标估计量。若在一级样本单位内按村的规模做了分层,应分别对各层按此公式进行计算,得到各层的总量,然后对各层总量求和,得到该一级样本单位的总量。G 1Y 的估计方差:v(Yk)= v(Yk_)L 1式中,v(Yk)为全省第k个子总体总量指标 Yk的估计方差,v(Y_)为第L层总量指标 Y_的估计方差,v(YL)为第L层
54、第i个一级样本单位总量指标 Y?Li的估计方差:A2 o、aL一 c f 一 aLvMl)=/ . 1-十 Nki”Li -YkL)2 +* v(Y?Li)%(现一1)1AlaL 匕、2vRiXNii 1-nkLi skLiI N kLi n nkLi苴中 Q2 skLi1nkLi 一1nkLi,-(YkLijj=1今YkLYkLNkL与无偏估计量中的相应方差公式类似,计算v(YkLi)时同样应注意与计算 Y?Li的方法相互一致。在一级样本单位内按村规模进行了分层时,应分别对各层按此公式进行计算,然后进行求和,得到 该一级样本单位的方差。fY?的最大相对误差:rk = Tv(Yk)k(三)估计
55、全省第k ( k = 4)个子总体的企业单位数G 1 AaL1.子总体企业单位总数估计量:N?kNkLikkLiL 4 aL i 4式中,NkLi为清查得到的第 L层第i个县、区中第k个子总体的企业单位总数。2. N?k的估计方差:v(Nk)aL aL-?21- AL , (NkLi -Kl)2 ALi J其中:N?kLkLaLaL、NkLii 13. N?k的最大相对误差: kN七、主要符号及定义(一)角标k代表不同的子总体,本部分 k取值4,表示城镇个体经营单位子总体。L代表不同的一级单位层(L=1,2, , G , G +1),本部分一级单位共分为 G +1个层。i代表不同的一级单位。
56、h表示不同的企业单位。(二)A为省内全部一级单位总数,AL为第L层一级单位总数,a为全省所有一级样本单位总数,aL为第L层一级样本单位数;(三)Nk为全省第k个子总体的企业单位总数,N?k为其估计量。NkL为第L层第k个子总体的企业单位数,N?kL为其估计量。N kLi为第L层第i个一级样本单位中第 k个子总体的企业单位 数,N?kLi为其估计量。(四)Yk为全省第k个子总体的总量指标值,耳为其估计量。YkL为第L层的总量指标值,Y?l为其估计量。YkLi为第L层第i个一级样本单位的总量指标值,YkLi为其估计量。YkLih为第L层第i个一级样本单位第h个企业单位的指标值。YkLi为第L层第i
57、个一级样本单位的企业平均指标估,一 ?计量。YkL为第L层的企业平均指标估计量。(五)v(Yk)为全省第k个子总体总量指标 Yk的估计方差,v(YL)为第L层总量指标估计量YkL的估计方差;v(N?k)为全省第k个子总体企业总数估计量N?k的估计方差,v(白也)为第l层企业单位总数估计量N?kL的估计方差。(六 ) rk 为全省第k 个子总体总量指标的最大相对误差,rN 为全省第k 个子总体企业总数的最大相对误差。第四部分一阶段整群抽样设计方案的第二部分中为村及村以下企业子总体设计了二阶段整群抽样方法,可能不适合一些省(区、市)的具体情况,主要表现在:.一些省(区、市),特别是直辖市的一级单位
58、个数很少,不适宜采用多阶段抽样,可以采用 一阶段整群抽样。.一些省(区、市)的村及村以下企业个数很少,不宜采用整群抽样,可以对村及村以下企业 部分采用目录抽样。3.一些省(区、市)的村及村以下企业比较发达,部分企业规模很大,可以采用目录抽样与整 群抽样相结合的办法。目录抽样方法在第一部分已经给出,本部分给出一阶段整群抽样方法,供有关的省(区、市)选择。采用本方法,无需先抽样本县、区,而是在全省范围内直接抽取行政村。本方法与前面第 二部分介绍的方法比较接近,因此下面的重点在于说明本方法与前面方法的不同之处,相同之处 则予以简化。一、建立抽样框抽样框包括所有行政村,需要对所有的县、区进行预先清查。
59、二、分层采用本方法时,可以按县进行分层,即每个县、区作为一个层,或直接将所有行政村按其工业总产值或企业个数进行分层,也可以不分层,各省可视本省情况而定。三、确定样本量和抽取样本(一)确定样本量。由于本方法是一阶段整群抽样,因而只需确定样本村(街道或居委会)数。计算过程与第二部分中一级样本量的计算方法是一样的。(二)抽取样本。根据计算出的样本村数,在全省范围直接抽取样本村,若采用了分层,则在 每个层分别抽取样本。抽取方法可以采用按某种标识排队,如按村及村以下企业工业总产值或企 业数等排队的等距抽样,或采用简单随机抽样。四、估计量下面的公式是按未分层的情况给出的,若采用了分层,则按下面的公式计算出
60、每个层的总量指标及其方差,然后进行加总,即可得到分层条件下的总量指标及其方差。bkbk Nkj“ Ykj.一 ,一 Ykjh(一)子总体总量指标估计量:Yk = Nk看一 =N kj詈一(k = 2,3)、Nkj, Nkjj ij i 今Y?(二)第k个子总体的企业平土指标估计量:Yk =Nk(三)Yk的方差估计量:v(Yk)三B21 如仁N d(bk 叭Bk 人.Ykj为企 Nkj二Ykjhkj h =1(四)符号定义和计算方法。Ykj为第j个样本村的第k个子总体的总量指标估计量,业平均指标估计量:NkjYkj -Ykj = Ykjhhd式中,Bk为全省有第k个子总体的企业单位的村总数,bk
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 某造船厂操作安全准则
- 轮胎厂质量管理体系
- 统编版六年级语文:看拼音写词语古诗课文积累
- 湖南电气单招笔试题目与答案解析
- 农村小学教师第一学期个人工作总结
- 2026职测言语理解与表达20题
- 铝合金性能特点试题及答案
- 高一历史考点分析试题及答案
- 油橄榄试题及答案
- 2025届上饶市玉山县数学四年级第二学期期末教学质量检测模拟试题含答案
- 2026广西来宾市商务局招聘编外聘用人员10人备考题库及完整答案详解(必刷)
- 2026年上半年教师资格证考试《高中地理学科知识与教学能力》真题
- SYT 6620-2025《立式圆筒形钢制焊接储罐完整性评价技术规范》
- 2026年消防局文员考试试题题库及答案解析
- 2026年公共卫生执业医师考试(实践技能)综合能力测试题及答案
- 华为CAE试题及答案
- 2026年完整军队文职考试真题解析试卷及答案
- 2026年留疆战士选拔章节练习题及深度解析
- 2026年球星卡行业分析报告及未来发展趋势报告
- 2026年临床检验标本采集指南
- 瓦斯隧道安全管理
评论
0/150
提交评论