面板数据分析第一讲数据_第1页
面板数据分析第一讲数据_第2页
面板数据分析第一讲数据_第3页
面板数据分析第一讲数据_第4页
面板数据分析第一讲数据_第5页
已阅读5页,还剩10页未读, 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、面板数据计量分析白仲林第一讲 面板数据因家庭得到的面板数据越来越多,面板数据的计量分析可以说是过去三十年应用研究领域所取得的最重要的进展。Fitzgerald, Gottschalk 和Moffitt(1998, P252)第一讲 内容面板数据面板数据的优点与缺陷扩展的面板数据面板数据线性回归模型体系面板数据单因素误差模型面板数据双因素误差模型第一节 面板数据1.1 面板数据“面板数据”一词指的是一部分家庭、或企业等在一段时期内的观测值所的集合。这样的数据可以通过在一段时期内对一些家庭或进行跟踪来获得。的截面观测值,并且,从纵剖面看从横截面看,面板数据是由若干在某一时点每个都是一个时间序列。1

2、978-2005 中国级地区消费性占可支配收入比例走势图(张晓峒绘制)面板数据计量分析白仲林面板数据通常分为两类:数据得到的面板数据通常被称为微观面板(micro panels)。由微观面板数据的特点是数 N 较大(通常是几百或几千个),而时期数 T 较短(最少是 2 年,最长不超过 10 年或 20 年)。由一段时期内不同的数据得到的面板数据通常被称为宏观面板(macro panels)。这类数据一般具有适度规模的N(从 7 到 100 或 200 不等,如七国,OECD,欧盟,发达或),时期数 T 一般在 20 年到 60 年之间。因数据结构上的区别,微观面板和宏观面板要求使用不同的计量方

3、法。 样本容量的区别微观面板必须研究 T 固定而 N 较大时的渐近特性,而宏观面板的渐近特性则是指 T 和 N都较大时的情况。平稳性对于宏观面板,当时间序列较长时需要考虑数据的非平稳问题,如根、结构突变以及协整等;而微观面板不需要处理非平稳问题,特别是每个家庭或相关性的时期数 T 较短时。在处理宏观面板时必须考虑之间的相关性,而在微观面板中,如果是随机抽样产生,则之间不大可能存在相关性,因此不需要考虑此问题。1.2 为什么使用面板数据?它们的优点和局限性1 面板数据的优点使用面板数据具有下列一些好处:()可以面板数据能反映异质性、企业、州或之间存在的异质性,即时间上和空间上的异质效这种异质性,

4、因而其结果很可能是有偏的。应。而时间序列数据和横截面分析没有例如,Baltagi 和 Levin(1992)研究 1963-88 年美国 46 个州的香烟需求问题时,设定需求模型Ditf (Di,t -1advt ")=pitIitreliiedui则模型中解释变量包括两大类可观测的和不可观测的,可分为如下四种:z第一类是可观测的时变异质因素,即,随(州)和时间的变化而变化的可观测变量,如香烟消费量的滞后项、价格和收入等可观测的变量;z第二类是随(州)变化而不随时间变化的可观测变量,如(religion)和教育等变量,即可观测的非时变异质因素;z第三类是不随(州)变化而随时间变化的可

5、观测变量,如电视和广播中的等变量,即可观测的时变同质因素;最后一类是一些不可观测变量,它们包括三种zu 非时变异质性不可观测因素( xi )效应u 时变同质性不可观测因素( lt )时间效应面板数据计量分析白仲林u 时变异质性不可观测因素( uit )剩余效应这样,模型可设定为Ditf (Di,t-1eduiadvt ) + xi + lt + uit=pitIitrelii事实上,对于变量,人们不可能得到每年每个州某一人数占总人口的百分比,所以一般认为不同年份的百分比也有太大变化。同样,完成高中或大学学业的人数占总人口的百分比也是如此。电视和广播中的同而变化。是性的,它对需求的影响随着州的不

6、显然,遗漏第四类中任何一种不可观测因素就会导致估计结果的偏倚,面板数据模型能够基于这四类中的所有变量建模,而纯时间序列和横截面分析就无法做到。另外,Hajivassiliou(1987)给出了一个宏观的面板数据研究了外债偿付问题。这些的例子,他使用 1970-82 年 79 个发展中和在殖民历史、金融机构、信仰等方面存在差异,所有这些反映特征的特定变量都会影响它们在借债或拖欠方面的态度,同时也会影响债权国对待它们的方式。如果不考虑这些出现严重的设定错误。(2)面板数据模型容易避免多重共线性问题之间的异质性就会zzzz面板数据具有的信息;面板数据具有更大的变异;面板数据的变量间更弱的共线性;面板

7、数据模型具有更大的自由度以及更高的效率。时间序列研究中令人烦恼的问题之一是多重共线性;比如在上述香烟需求的研究中,如果从总量的角度看价格和收入就具有很强的共线性,而使用美国各州的面板数据,存在共线性的可能就很小了,因为增加截面价格和收入的信息。维度的同时也增加了数据的变异,也增加了有关事实上,数据中的变异可以分为两个部分,一是州与州之间由于规模和特征的不同所表现出的变异性;二是各州内部不同时间上表现出的变异性,前者的变异程度往往更大。使用、更有信息的数据就可以得到更可靠的参数估计值。当然,这要求不同州的变量间应具有相同的关系式,换句话说,这要求数据是可混合的(poolable)。(3)面板数据

8、更适合于研究动态调整过程面板数据适用于研究失业、贫困等状态的持续性问题的研究。如果这些面板数据的时期数足够长,它们就能够清楚地反映对政策变化的调整速度。比如,在衡量失业问题时,横截面数据可以估计出人口中多大一部分比例在给定的时间处于失业状态,多个截面可以表明这一比例如何随时间而变化。但是,只有面板数据才能估计出在某个时期失业人中有多大一部分在另一个时期仍处于失业状态。Deaton(1995)指出,与横截面不同,面板可以获得家庭或变化的数据。它可以使我们观测到生活标准在发展过程中如何变化;可以使我们确定谁从发展中受益;而且还可以使我们观测到 “在收入动态变化中,贫困到底是暂时性的还是长期的状态。

9、”面板数据计量分析白仲林由于面板数据可以将在某个时点的经历和行为与另一个时点的其他经历和行为起来,因此,面板数据在估计短期关系、生命周期模型和代际模型时也是必需的。(4)面板数据还可以识别、测量单纯使用横截面或时间序列数据无法估计的影响。 对于由妇女组成的横截面样本,其中年平均就业率是 50%. 这可能是由于下面两种导致的:(a)每个妇女在任一给定年份有 50%的概率就业;(b)样本中有 50%的人一直有工 作,50%的人根本不工作。情况(a)中的工作转换频率很高,而情况(b)中没有工作转换,只有使用面板数据才能区分这两种情况。(5)与纯横截面数据或时间序列数据相比,面板数据模型为模型。构建并

10、检验更复杂的行比如,对技术效率问题使用面板数据建模研究效果更好(Baltagi 和 Griffin,1988;Baltagi, Griffin 和 Rich,1995;Koop 和 Steel,2001)。另外,在分布滞后模型中使用面板数据比使用纯时间序列数据需要的约束条件更少(Hsiao,2003),因为通常使用 GMM 估计。(6)基于、企业或家庭所搜集的微观面板数据与在宏观层次上所搜集的类似变量相比更加准确,而且还可能消除企业或(7)例如,与时间序列分析中进行根检验通常具有标准的渐近分布。数据汇总所导致的偏倚。根检验遇到的非标准分布问题不同,面板2 面板数据的局限性面板数据的局限性包括:

11、(1)微观面板数据极少Kasprzyk 等(1989)详细讨论了有关设计面板、数据收集和数据管理的问题。这些问题包括:覆盖面问题(样本没覆盖研究总体)、不响应问题(由于回答者不合作或提问者的)、回忆问题(回答者的记忆时间问题和样本期内偏倚问题。确)、采访的频率问题、采访的时间间隔问题、询问的(2)测量误差的扭曲(distortions)严重在面板数据被者,错误(3)面板数据中,问题不清晰,记忆错误,故意歪曲回答(例如威望偏倚),不合适的回答者的应答以及采访者的影响等导致出现严重的测量误差。的样本选择问题z自选择例如,由于个人保留工资高于工作工资,人们通常选择不去工作。在这种情况下,观测到的只是

12、这些人的特征,而观测不到他们的保留工资。由于他们的工资数据,产生删失样本。但是,如果这些人的所有数据都不可观测,这就成为一个截断样本。因此,面板数据容易产生样本的选择有偏性。z未回答面板数据容易产生单项(或部分)未回答或完全未回答。这时,除了由于数据导致的效率损失之外,面板数据中的未回答还可以导致严重的总体参数识别问题。z非随机样本流失在面板数据的随后,由于对象的非随机(如,低收入区域向高收入区面板数据计量分析白仲林,会产生对象的严重流失。Fitzgerald 等域的)或发现回答的成本过高等(1998)指出,面板数据使用价值的最大潜在威胁是有偏性流失。Lillard 和 Panis(1998)

13、研究发现,PSID 的样本流失有很强的选择性。例如,受教育程度较低的以及较大的最容易从样本中剔除,而已婚的人继续留在样本内的可能性较大。被者在样本内的时期越长,继续参与的倾向就越小。在欧洲,(第一次和第二次之间的)样本流失率从意大利的 6%到英国的 40%不等。平均的样本流失率大约是 10%. 为了解决样本非随机流失的影响,人们逐渐使用轮换面板(rotating panel)和伪面板(pseudo-panel)。(4)时间维度短微观面板通常是年度数据,每个行渐近统计分析。(5)截面相关性的时期数较短。因此,主要依赖数趋于无穷进或地区的宏观面板数据,如果时间序列较长而且没有考虑到之间的相关性就会

14、导致错误的推断结论。事实上,考虑截面相关非常重要,而且会影响到统计推断的结论。为此,人们也提出了考虑这种相关性的面板根检验方法。1.3 扩展的面板数据1 伪面板数据1985 年,Deaton(1985)指出“由于统计的样本轮换和样本非随机流失问题,绝大多数并不存在较长时间跨度的真正面板数据,或者这样的真正面板数据是难以获得的,对于的微观变量尤其如此。”并且,Deaton 发现“虽然某变量的统计抽样不能连续到各的观测数据,但是,如果按照某种属性(例如,、职业和等)将各期对象分成不同的群(Cohort);对于各个观测期,选择各群内观测数据的均值(中位数或分位数),即可构造以群为的面板数据”。于是,

15、对于截面时间序列的统计数据,基于某种属性分群,称以群为而构造的人工面板数据为伪面板数据(Pseudo Panel Data)。众所周知,面板数据的本质是在观测期内的每期都能观测到相同的相关数据,然而,伪面板显然并非如此。在观测期内,它每期观测的不同,并且重点关注的是群的统计特征,即通过群均值和群方差的发展变化,来揭示相关变量的总体分布特征。例如,为了基于城市住户抽样数据研究城市居民收入的动态行为,常见的分群标准是户主段、户主出生年的区间和户主职业类别。户主按出生年的区间分群,在各观测期,同群中的不同家庭都是户主在同一出生年区间的家庭,不同群的家庭是户主在不同出生年区间的家庭。如,对于 1963

16、-1967 年出生的群,在 1988 年时,该群内的家庭是户主为 21-25 岁的家庭;时,该群内的家庭是户主为 22-26 岁的家庭;依此类推,2008 年时,该群内的家庭是户主为 41-45 岁的家庭。然后,在各年,对该群群内的家庭人均收入求均值。这样,对于 1963-1967 年出生的群,可得到该群的人均收入时间序列。于是,对于不同的群就可构造一个关于家庭人均收入的面板数据,称之为按出生年分群的家庭人均收入伪面板数据计量分析白仲林面板数据。类似地,也可以构造按段分群的人均收入伪面板数据。应用群体分析方法得到的伪面板数据还具有以下优点。一是伪面板数据是由各群群内个体属性的总体统计量组成,与

17、一般面板中的数据相比,前者消除了的测量误差,且避免了样本流失。二是由于不需要在每期中追踪固定的,这样可得到更长时间跨度的数据。但是,也产生了新的问题,例如,无意义的效应、滞后数据的不可观测。2 轮换面板因为同一个家庭可能不愿被一次又一次的被回访,为了保持中家庭数目相同,在第二期中的部分家庭,被相同数目的新的家庭所替代,这在获得面板数据时是必要的。Biorn(1981)研究了这种轮换面板的情况。在 Biorn 和 Jansen(1983)的研究中,他们基于挪威家庭预算的数据,其中一半的样本在每次中被轮换掉。换句话说,就是每一期的样本中将有一半家庭,并被新的家庭替代。假设T = 2 ,并且每期中有

18、一半的样本被轮换,在这种情况下,不失一般性,在第 2期,家庭 1, 2,", N / 2 被家庭 N +1, N + 2,", N + N / 2 所替代,很明显,只有家庭N /2 +1, N /2 + 2,", N 被观测了两期。这个例子中有3N / 2 个不同的家庭,只有 N /2 个家庭被观测了两期。最初和最后的 N /2 个家庭只被观测了一期。研究者检验 “抽样时间(time-in-sample)”偏倚效应的存在性。“抽样时间”轮换面板偏倚是指初次采访和随后的采访之间的回答有显著的改变。对于轮换面板,每批加到面板的新组提供了检验抽样时间偏倚效应的方法。例如

19、,Solon(1986)等研究发现第一次轮换所报告的失业率比基于全样本的失业率高出10 个百分点。这些发现表明在面板数据中普遍存在着轮换组偏倚效应,而实践中条件并没有保持不变,因而很难把抽样时间偏倚效应同其他效应区。3 空间面板数据在水平的随机抽样样本中,人们很少担心截面之间的相关性。然而,当考虑,地区,州,县等相关截面数据时,这些总量可能表现出必须处理的截面相关性。现在有大量运用空间数据的文献处理这种相关性。这种空间相依模型在区域科学和城市学中比较普遍。具体来说,这些模型使用距离测度设定了面板数据的空间自相关性和空间结构(空间异质性),这方面文献的详尽介绍可以参见 Anselin(1988,

20、 2001)。近年来,在中,空间面板模型变得越来越有吸引力。学的在包含空间误差自相关和空间滞后被解释变量的情形下,Elhorst(2003)讨论了固定效应和随机效应面板数据模型的 ML 估计。他们也对随机系数模型作了相应的扩展。在包含空间误差自相关,或者空间滞后被解释变量的情形下,Elhorst(2005)研究了固定效应动态面板数据模型的估计。4 计数面板数据被解释变量是计数面板数据的例子很多。例如,一段时间内一家公司的竟标次数、一个面板数据计量分析白仲林人去看医生的次数、每天吸烟者的数量及一个研发机构登记专利的数目。虽然可以运用传统面板回归模型对计数面板数据建模,但鉴于被解释变量具有 0 及

21、非负离散取值的特征,运用泊松面板回归模型建模更为合适。在计数面板数据的文献中,尽管泊松模型设定非常流行,但由于其均值与方差相等的性质而备受批评。在实证分析中更常见的是过度离差的情形。为了对过度离差建模,经常设定数据服从负二项分布,Hausman.(1984)研究了负二项分布面板数据模型。而且,负二项分布面板数据模型也能够在 Stata 软件 xtpoisson,fe and re 软件包中实现。然而,面板数据不是灵丹妙药,它并不能解决时间序列或横截面研究中解决不了的所有问题。例如,面板根检验比单一时间序列的根检验功效更高,这应该能更好地推断力平价(PPP)和增长收敛问题。事实上,在导致大量经验

22、应用研究的同时,也引来了一些批评,Maddala(1999)和Banerjee 等(2004,2005)认为面板数据也不能解决 PPP 以及增长收敛的问题。面板数据计量分析白仲林第二节 面板数据回归模型2.1 面板数据回归模型的一般形式面板数据模型的一般形式如下:Kyit = åbkit xkit + uitk =1(2.1)其中, i = 1,2,3,", N ,表示 N个; t = 1,2,3,",T ,表示已知的 T 个时点。 yit 是被解释变量对i 在 t 时的观测值;xkit 是第 k 个非随机解释变量对于i 在 t 时的观测值;bkit是待估计的参数

23、; uit 是随机误差项。特别,当回归系数只与有关,不随时间变化时,即, bkit = bki 时,模型(2.1)可用矩阵表示为Yi = Xi i + Ui( i = 1,2,3,", N )(2.1)é b1i ùé yi1 ùxKi1 ùéui1 ùê y úúêu úê b úx= êi 2 úKi 2 ú= ê2i ú= êi 2 ú, X =其中, Y, U,.

24、34;úêúêúiê # úi#i#"#i#ê y úúêu úêb úxëiT ûT ´1KiT ûT ´K ëKi û K ´1ëiT ûT ´12.2 面板数据回归模型的分类通常,对模型(2.1)将做许多限制性假设,使其成为不同类型的面板数据回归模型。一般来说,常用的面板数据回归模型有如下九种模型,下面分别介绍它们。1 混合回归模型

25、从时间上看,不同之间不存在显著性差异;从截面上看,不同截面之间也不存在显著性差异,那么就可以直接把面板数据混合在一起,用普通最小二乘法(OLS)估计参数。即估计模型K i.i.d (0s 2 )y = b + å bx+ u, u(2.2)it1k kitititk =2Y = X b + U(2.2)面板数据计量分析白仲林é b1 ùé Y1 ùé X1 ùé U1 ùêY úê X úêU úê b ú= ê2

26、ú= ê2 ú, = ê2 ú, U = ê2 ú其中, Y, X.êúêúêúê # ú#êúêúêúêúbYXUëN û NT ´1ëN ûNT ´K ëK û K ´1ëN û NT ´1例如:如果劳动力市场、市场和商品市场是有效的,那么,在和

27、各地区()技术效率相同的假设下,根据各地区的面板数据利用 Cobb-Dauglas 生产函数估计劳动和对产出的贡献时,可以将模型设定为混合回归模型。实际上,混合回归模型(Pooled Regression Ms)假设了解释变量对被解释变量的影响与无关。模型中的解释变量部分表示可观测同质时变效应、而且同分布的误差项(不可观测的时变异质性)也未包含不可观测的非时变异质性和同质的时变效应。因此,混合模型不仅不能体现模型数据的信息优势,而且对实际问题进行了严格的约束(如, Cobb-Dauglas 生产函数中技术不变的假设)。尽管混合回归模型在早期被广泛应用,但是,在许多问题的研究中,混合回归模型并不

28、适用(Mairesse & Griliches,1990)。2 单因素效应模型所谓单因素效应模型,就是在模型中考虑了不可观测非时变()异质效应,或者,考虑了不可观测时变()同质效应的模型,因此,单因素效应模型分为模型和时间单因素效应模型两类。单因素效应(1)单因素效应模型在面板数据线性回归模型中,如果在混合模型中添加了反映不可观测非时变的(异质效应项,即称模型)Kx+ x + u , u i.i.d (0s 2 )y = a + åb(2.3)itk kitiititk =2为单因素效应模型,矩阵形式为) +UY = aiNI Äi(2.3)=(1,1)'

29、的克罗内克积,其中, I Äi矩阵 I 和 T 阶列向量i",是 N 阶NTNTé x1 ùé b2 ùùúúúé X1 ù""""2ê x úê X úê b ú= ê2 ú, b = ê3 úx = ê2 ú, X =, X.êúêêêúê

30、50;i#úê X úêb úêx úxKiT ûT ´( K -1)ëN û NT ´( K -1)ëK û( K -1)´1 ëN ûN ´1iTiT类似地,如果劳动力市场、市场和商品市场是有效的,那么,在假设下,根据各地区的面板数据利用 Cobb-Dauglas 生产函数估计劳动和对产出的贡献时,可以将模型设定为单因素效应模型。这时各地区()的技术效率不同。显然,与混合回归模型比较,异质性对模型参数估计的影响。

31、单因素效应模型更合意,它了不可观测的非时变变的全球技术进步非时非时变同质效应的平均水平,截距项反映了不可观测的全球技术进步非时变面板数据计量分析白仲林(2)时间单因素效应模型类似地,在面板数据线性回归模型中,如果在混合模型中添加了反映不可观测的时变(个体)同质效应项,即称模型Kx+ l + u ,u i.i.d (0s 2 )y = a + åb(2.4)itk kittititk =2为时间单因素效应模型,矩阵形式为)l +UY = aiNi Ä I(2.4)Ä IT 是 N 阶列向量iN = (1,1)' 和 T 阶",矩阵 IT 的克罗内克

32、积,其中,Né l1 ùé b2 ù""""ùúúúé X1 ù2ê X úê b úêl úl = ê2 ú= ê2 ú, b = ê3 ú, X =, X.êêêúêúê # úi#úê X úêb ú&#

33、234;l úxëT ûT ´1KiT ûT ´( K -1)ëN û NT ´( K -1)ëK û( K -1)´1 iTiT类似地,如果劳动力市场、市场和商品市场是有效的,那么,在各地区()技假设下,根据各地区的面板数据利用 Cobb-Dauglas 生产函数估计劳动和对产出的贡献时,可以将模型设定为时间单因素效应模型。这时全球技术进步是时变。显然,与混合回归模型比较,时间单因素效应模型更合意,它质性对模型参数估计的影响。(3)固定效应和随机效应固定效应模型了不可观测的

34、时变同对于单因素效应模型,为了估计单因素效应,可以将它们设定为确定性因素,并且,对所有的 i 和 t,假定 Xit 与uit 是相互的,这时,单因素效应模型被称为固定效应模型。实际上,只要结论被限定是所研究行为的时候,即我们要做出的推断是基于样本个体,那么,固定效应模型是一个合适的设定。显然,对于固定效应模型(individual fixed effects regression m),为了估计效应,估计时需要添加 N 个虚拟变量,其取值矩阵为( IT ÄiN ) ;对于时间固定效应模型(timefixed effects regression m矩阵为(iN Ä IT )

35、 .),为了估计时间效应,估计时需要添加 T 个虚拟变量,其取值另外,Mundlak(1978)认为单因素固定效应模型所有的解释变量是内生的。Hausman和 Taylor(1981)也指出固定效应模型一些解释变量和单因素效应是可以相关的。例如,在收入方程中,i 可能代表不可观测的个人能力,它可能与方程右边的受教育变量相关。Chamberlain(1984)表明固定效应模型对所有被解释变量的超前和滞后项关于解释变量的超前和滞后项的回归系数施加了可检验的约束。因此,在采用固定效应模型之前应该检验这些约 束条件的有效性,例如,Hausman 检验和 Chamberlain 检验(见 Baltagi

36、,2008,chapter 4)。事实上,固定效应模型和随机效应模型的问题曾经在生物计量学和统计学文献中产生了术效率相同的面板数据计量分析白仲林热烈的争论,并且已经延伸到使用面板数据的计量学文献中。Mundlak(1961)和 Wallace和 Hussain(1969)是固定效应模型的早期拥护者,而 Balestra 和 Nerlove(1966)则是随机单因素误差模型的支持者。因此,使用固定效应模型存在面的缺陷: 如果不可观测的非时变异质性效应(单因素效应)或者不可观测的时变同质性效应(时间单因素效应)与不可观测的时变异质性效应(误差项)相关时,OLS 估计量是有偏的; 固定效应模型的参数

37、太多,影响估计自由度; 固定效应模型的结论仅适用于样本内,不能对样本外的固定效应模型的估计行为进行推断。对于固定效应模型可以采用在模型中加虚拟变量的方法估计回归参数,并称其估计值为LSDV 估计(The Least Square Dummy Variable Estimation)。也可以基于组内离差数据的最小二乘法估计固定效应模型参数,简记为组内估计。随机效应模型对于单因素效应模型,如果不关注单因素效应,仅关心解释变量的效应时,可假定单因素效应 i(或者,时间单因素效应 t)是随机的,这样以来,在固定效应模型中存在的OLS 估计量有偏、自由度损失过多和结论不能对样本外的以避免。即行为进行推断

38、的三个问题就可对于单因素效应模型K= a + å bk xkit + xi + uityitk =2 i.i.d (0s)u i.i.d (0s 2 ),i 与u 相互如果x2;并且,对于所有的 i 和 t,xiititXit 与 i 和uit 也相互,则称该模型为随机效应模型。显然,当 N 个样本定。例如,基于 OECD是随机抽样于一个总体时,那么随机效应模型就是一个恰当的设的数据,推断普遍适用的理论时,就可以设定随机效应模型。类似地,对于时间单因素效应模型K= a + å bk xkit + lt + uityitk =2如果l i.i.d (0s, u i.i.d (

39、0s 2 ),t 与u)2相互;并且,对于所有的 i 和 t,ltititXit 与 t 和uit 也相互,则称该模型为时间随机效应模型。对于随机效应模型可以采用可行的广义最小二乘法(FGLS)估计模型参数。3 双因素效应模型所谓双因素效应模型,就是在模型中既考虑了不可观测非时变的()异质效应,又考虑了不可观测时变()同质效应的模型。面板数据计量分析白仲林Kx+ x + l + u ,u i.i.d (0s 2 )y = a + åb(2.5)itk kititititk =2其矩阵表示为)x + (iN Ä IT ) l + UY = aiN+Äi(2.5)效应

40、 i 和时间效类似地,双因素效应模型也有固定效应和随机效应之分,如果设定应 t 是确定的,就是双因素固定效应模型;如果设定效应 i 和时间效应 t 是随机的,就是双因素随机效应模型。在实际应用时,模型的正确设定必须进行相关的统计检验。4 变系数模型确定系数面板数据模型在面板数据模型(2.1)中,如果解释变量对被解释变量的影响随着确定性参数时,称模型(2.1)为确定系数面板数据模型。的变化是不同的确定系数面板数据模型的矩阵形式为 Zellner(1962)的似不相关回归模型(SeeminglyUnrelated Regressions)Y = X b + U(2.10)é b1i &#

41、249;é b1 ùé X1ê 00""%000#ùúúúêb úê b úX#0= ê= ê2i ú, b = ê2 ú, b其中, X2êêúêú#i#ê 0úê b úêb úXëN û NT ´ NKëki ûK ´1ëN ûKN ´15 随机系数面板数据模型面板数据模型(2.1)揭示了不同的相同现象,于是,如果 N 个是从某个总体随机抽取的一个样本时,面板数据模型(2.1)的参数列向量 bi 就是随机向量。另外,如间是空间相关时,面板数据模型(2.1)的 N 个参数列向量的集合bi |i = 1,2,", N 可果以被看成是同一个总体的 N 个样本。

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论