版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、20世纪一一主流统计方法技术:因素分析回归分析20世纪70年代:结构方程模型时代正式来临|结构方程模型是一门基于统计分析技术的研究方法学,它主要用于解决社会科学研 究中的多变量问题,用来处理复杂的多变量研究数据的探究与分析。在社会科学及经济、 市场、管理等研究领域,有时需处理多个原因、多个结果的关系,或者会碰到不可直接 观测的变量(即潜变量),这些都是传统的统计方法不能很好解决的问题。SEH能够对 抽象的概念进行估计与检定,而且能够同时进行潜在变量的估计与复杂自变量/因变量 预测模型的参数估计结构方程模型是一种非常通用的、主要的线形统计建模技术,广泛应用于心理学、经济 学、社会学、行为科学等领
2、域的研究。实际上,它是计量经济学、计量社会学与计量心理学 等领域的统计分析方法的综合。多元回归、因子分析和通径分析等方法都只是结构方程模型 中的一种特例。结构方程模型是利用联立方程组求解,它没有很严格的假定限制条件,同时允许自变量 和因变量存在测量误差。在许多科学领域的研究中,有些变量并不能直接测量。实际上,这 些变量基本上是人们为了理解和研究某类目的而建立的假设概念,对于它们并不存在直接测 量的操作方法。人们可以找到一些可观察的变量作为这些潜在变量的"标识”,然而这些潜 在变量的观察标识总是包含了大量的测量误差。在统计分析中,即使是对那些可以测量的变 量,也总是不断受到测量误差问题
3、的侵扰。自变量测量误差的发生会导致常规回归模型参数 估计产生偏差。虽然传统的因子分析允许对潜在变量设立多元标识,也可处理测量误差,但 是,它不能分析因子之间的关系。只有结构方程模型即能够使研究人员在分析中处理测量误 差,又可分析潜在变量之间的结构关系。简单而言,与传统的回归分析不同,结构方程分析能同时处理多个因变量,并可比 较及评价不同的理论模型。与传统的探索性因子分析不同,在结构方程模型中,我们可 以提出一个特定的因子结构,并检验它是否吻合数据。通过结构方程多组分析,我们可 以了解不同组别内各变量的关系是否保持不变,各因子的均值是否有显著差异。”目前,已经有多种软件可以处理SEM,包括:LI
4、SREL, AMOS, EQS, Mplus.结构方程模型包括测量方程(LV和的之间关系的方程,外部关系)和结构方程(LV之 间关系的方程,內部关系),以ACSI模型为例,具体形式如下:测量方程 y =/yri + Ey , x= Ax 4 + e x=(l)结构方程 ri=Bn +E + g 或(I-B) n =E + g (2)其中,H和E分别是内生LV和外生LV y和x分别是和的MV, Ax和八y是载荷矩阵, B和是路径系数矩阵,£和©是残差。6 2负荷量 潜在变量观察变址误差000三种分析方法对比线性相关分析:线性相关分析指出两个随机变量之间的统计联系。两个变量地位
5、平 等,没有因变量和自变量之分。因此相关系数不能反映单指标与总体之间的因果关系。线性回归分析:线性回归是比线性相关更复杂的方法,它在模型中定义了因变量和 自变量。但它只能提供变量间的直接效应而不能显示可能存在的问接效应。而且会因为 共线性的原因,导致出现单项指标与总体出现负相关等无法解释的数据分析结果。结构方程模型分析:结构方程模型是一种建立、估计和检验因果关系模型的方法。 模型中既包含有可观测的显在变量,也可能包含无法直接观测的潜在变量。结构方程模 型可以替代多重回归、通径分析、因子分析、协方差分析等方法,清晰分析单项指标对 总体的作用和单项指标间的相互关系。结构方程模型假设条件合理的样本量
6、(James Stevens 的 Applied Multivariate Statistics for the Social Sciences 书中说平均一个自变量大约需要 15 个 case; Bent 1 er and Chou (1987) 说平均一个估计参数需要5个case就差不多了,但前提是数据质量非常好;这两种说 法基本上是等价的;而Loehlin (1992)在进行蒙特卡罗模拟之后发现对于包含24个 因子的模型,至少需要100个case,当然200更好;小样本量容易导致模型计算时收 敛的失败进而影响到参数估计;特别要注意的是当数据质量不好比如不服从正态分布或 者受到污染时,更需
7、要大的样本量)连续的正态内生变量(注意一种表面不连续的特例:underlying continuous ; 对于内生变量的分布,理想情况是联合多元正态分布即JMVN)模型识别(识别方程)(比较有多少可用的输入和有多少需估计的参数;模型不 可识别会带来参数估计的失败)完整的数据或者对不完整数据的适当处理(对于缺失值的处理,一般的统计软件 给出的删除方式选项是pairwise和1 istwise,然而这又是一对普遍矛盾:pairwise式 的删除虽然估计到尽量减少数据的损失,但会导致协方差阵或者相关系数阵的阶数n参 差不齐从而为模型拟合带来巨大困难,甚至导致无法得出参数估计;listwise不会有
8、 pairwise的问题,因为凡是遇到case中有缺失值那么该case直接被全部删除,但是 又带来了数据信息量利用不足的问题一一全杀了吧,难免有冤枉的;不杀吧,又难免影 响整体局势)模型的说明和因果关系的理论基础(实际上就是假设检验的逻辑一一你只能说你 的模型不能拒绝,而不能下定论说你的模型可以被接受)结构方程模型的技术特性:1. SEH具有理论先验性2. SEM同时处理测量与分析问题3. SEH以协方差的运用为核心,亦可处理平均数估计4. SEH适用于大样本的分析般而言,大于200以上的样本,才可称得上是一个中型样本。5. SEM包含了许多不同的统计技术。6. SEH重视多重统计指标的运用结
9、构方程模型的实施步模型设定。研究者根据先前的理论以及已有的知识,通过推论和假设形成一个关于一 组变量之间相互关系(常常是因果关系)的模型。这个模型也可以用路径表明制定变量 之间的因果联系。模型识别。模型识别时设定SEM模型时的一个基本考虑。只有建设的模型具有识别性, 才能得到系统各个自由参数的唯一估计值。其中的基本规则是,模型的自由参数不能够 多于观察数据的方差和协方差总数。模型估计。SEM模型的基本假设是观察变量的反差、协方差矩阵是一套参数的函数。 把固定参数之和自由参数的估计带入结构方程,推导方差协方差矩阵艺,使每一个元素 尽可能接近于样本中观察变量的方差协方差矩阵S中的相应元素。也就是,
10、使工与S之 间的差异最小化。在参数估计的数学运算方法中,最常用的是最大似然法(ML)和广义 最小二乘法(GLS)o模型评价。在已有的证据与理论范围内,考察提出的模型拟合样本数据的程度。模型 的总体拟合程度的测量指标主要有x2检验、拟合优度指数(GFI)、校正的拟合优度指数(AGFI)、均方根残差(RIR)等。关于模型每个参数估计值的评价可以用"t”值。模型修正。模型修正是为了改进初始模型的适合程度。当尝试性初始模型出现不能拟合观 察数据的情况(该模型被数据拒绝)时,就需要将模型进行修正,再用同一组观察数据来进 行检验。探索性分析定义:探索性因子分析法(Exploratory Fact
11、or Analysis, EFA)是一项用来找出多元观测变 量的本质结构、并进行处理降维的技术。因而,EFA能够将将具有错综复杂关系的变量综合 为少数几个核心因子。探索性因子分析(EFA)致力于找出事物內在的本质结构。残差指标探索性分析的适用情况:因子负荷潜变量在缺乏坚实的理论基础支撑,有关观测变量内部结构,一般用探索性因子分析。先用探 索性因子分析产生一个关于内部结构的理论,再在此基础上用验证性因子分析。但这必须用 分开的数据集来做。探索性分析步骤:1、辨别、收集观测变量。按照实际情况收集观测变量,并对其进行观测,获得观测值。 针对总体复杂性和统计基本原理的保证,通常采用抽样的方法收集数据来
12、达到研究目的。2、获得协方差阵(或Bravais-Pearson的相似系数矩阵)。我们所有的分析都是从原始 数据的协方差阵(或相似系数矩阵)出发的,这样使我们分析得到的数据具有可比性,所以 首先要根据资料数据获得变量协方差阵(或相似系数矩阵)。3、确定因子个数。有时候你有具体的假设,它决定了因子的个数;但更多的时候没有 这样的假设,你仅仅希望最后的到的模型能用尽可能少的因子解释尽可能多的方差。如果你 有k个变量,你最多只能提取k个因子。通过检验数据来确定最优因子个数的方法有很多, 例如Kaiser准则、Scree检验。方法的选择由,具体操作时视情况而定。4、提取因子。因子的提取方法也有多种,主
13、要有主成分方法、不加权最小平方法、极 大似然法等,我们可以根据需要选择合适的因子提取方法。其中主成分方法一种比较常用的 提取因子的方法,它是用变量的线性组合中,能产生最大样品方差的那些组合(称主成分) 作为公共因子来进行分析的方法。5、因子旋转。因子载荷阵的不唯一性,使得可以对因子进行旋转。这一特征,使得因 子结构可以朝我们可以合理解释的方向趋近。我们用一个正交阵右乘已经得到的因子载荷阵(由线性代数可知,一次正交变化对应坐标系的一次旋转),使旋转后的因子载荷阵结构简 化。族转的方法也有多种,如正交旋转、斜交旋转等,最常用的是方差最大化正交旋转。6、解释因子结构。最后得到的简化的因子结构是使每个
14、变量仅在一个公共因子上有较 大载荷,而在其余公共因子上的载荷则比较小,至多是中等大小。通过这样,我们就能知道 所研究的这些变量是由哪些潜在因素(也就是公共因子)影响的,其中哪些因素是起主要作 用的,而哪些因素的作用较小,甚至可以不用考虑。7、因子得分。因子分析的数学模型是将变量表示为公共因子的线性组合,由于公共因 子能反映原始变量的相关关系,用公共因子代表原始变量时,有时更利于描述研究对象的特 征,因而往往需要反过来将公共因子表示为变量的线性组合,即因子得分。验证性因子分析定义:验证性因子分析是对社会调查数据进行的一种统计分析。它测试一个因子与想对应 的测度项之间的关系是否符合研究者所设计的理
15、论关系。验证性因子分析(confirmatory factor analysis)的强项在于它允许研究者明 确描述一个理论模型中的细节。因为测量误差的存在,研究者需要使用多个测度项。当 使用多个测度项之后,我们就有测度项的"质量”问题,即效度检验。而效度检验就是 要看一个测度项是否与其所设计的因子有显著的载荷,并与其不相干的因子没有显著的 载荷。对测度模型的检验就是验证性测度模型。对测度模型的质量检验是假设检验之前的必要 步骤。负荷潜变量而验证性因子分析(CFA)是用来检验已知的特定结构是否按照预期的方式产生作用。残差观测变疑验证性凶分析的步骤:1、定义因子模型。包括选择因子个数和定
16、义因子载荷。因子载荷可以事先定为0或者 其它自由变化的常数。或者在一定的约束条件下变化的数(比如与另一载荷相等)。这是和 探索性因子分析在分析方法上的一个重要差异,我们可以用一个直观的比喻,也就是说探索 性因子分析是在一张白纸上作图,而验证性因子分析是在一张有框架的图上完善和修改。2、收集观测值。定义了因子模型以后,我们就可以根据研究目的收集观测值了。这一 点与探索性因子分析有一定的相似之处。3、获得相关系数矩阵。与探索性因子分析一样,我们的分析都是在原始数据的相关系 数矩阵基础上进行的,所以首先就要得到相关系数矩阵。实际上方差协差阵、相似系数矩阵 和相关阵之间是可以相互转化的。4、根据数据拟
17、合模型。我们需要选择一个方法来估计自由变化的因子载荷。在多元正 态的条件下,最常用的是极大似然估计,也可采用渐进分布自由估计。5、评价模型是否恰当。这一步可以说是验证性因子分析的核心。当因子模型能够拟合 数据时,因子载荷的选择要使模型暗含的相关阵与实际观测阵之间的差异最小。最好的参数 被选择以后,差异量能被用来作为衡量模型与数据一致的程度。最常用的模型适应性检验是 卡方拟合优度检验。原假设是模型是适应性模型,备择假设是存在显著差异。但是,这个检 验受样本量大小影响,包含大样本的检验往往会导致拒绝原假设,尽管因子模型是合适的。 其他的统计方法,比如用Tucker-Lewis指数,比较建议模型和&
18、#39;'原模型”的拟合度。这些方 法受样本量大小影响不大。6、与其他模型比较。为了得到最优模型,我们需要完成这一步。如果你想比较两个模 型,其中一个是另一个的缩略形式,你就能从卡方统计量的值检查出他们的差别,大约服从 卡方分布。几乎所有独立因子载荷的检验能用来作为全因子模型和简因子的模型之间的比较。 为以防你不是在检查全模型和简模型,你可以比较均方根误差的近似值(RMSEA),它是模型 中每个自由度差异的一个估计值。验证性分析适用情况验证性因子分析要处理推论统计量,处理难度要求髙。需要具备更大容量的样本。精确 的样本量要随着观测值和模型的因子数变化而变化,但一个标准模型至少需要200
19、个个体。 在进行分析过程中必须选择与每个因子在很大程度上匹配的变量,而不是可能是潜在变量的 “随机样本”。基于结构方程全模型的大学生就业预期情况分析0引言随着我国经济的不断发展,我国高校大规模扩招,越来越多的年轻人获得了接受教育的 机会。从社会发展的角度来讲,大批高素质的人才培养是与我国快速发展的社会经济水平相 适应的。然而,由此也带来了两方面的问题:一是本科生的就业矛盾日益突出,几乎每一个大学生都在切身感受就业的恐慌;二是人才的竞争加剧,加之市场对于人才的需求多元化,考研或出国深造成为提髙我们 本科生自身核心竞争力的一种渠道,同时也是规避就业难的一种新途径;那么,在如此就业形势严竣、人才竞争
20、加剧的当今社会,大学生们对自己将来的就业有 怎样的预期呢本论文基于辽宁工程技术大学数学与统计学院2005级统计系本科生于2007年10月至 11月期间收集的题目为“大学生就业与深造意向调查”的原始问卷资料,欲从大学生的就业 预期角度出发,结合结构方程模型,分析大学生预期就业手段和预期就业地域方面的相关情 况,并期望推广结构方程模型应用于问卷分析的方法。1问题分析研究目的本论文在采用量表方式对问卷中的定性变量予以赋值后,欲分析影响大学生预期就业手 段和预期就业地域的因素,并期望得到各个因素与大学生预期就业手段、预期就业地域之间 的关系的度量。需注意:该调查的调查对象是辽宁工程技术大学全日制在读本
21、科生。调查对象仅仅是来自大学 生这个总体的一个群或层。根据抽样调查的相关理论,辽宁工程技术大学在读本科生并不具 有典型代表性,即它作为大学生总体的一个群被抽出并不具备随机性和强代表性。因此,本 论文从这份调查数据出发,仅仅只是从一个相对小的视角研究大学生预期就业手段、预期就 业地域方面的情况,结果不一定适用于大学生总体。(2)问卷数据归属于2009年10月这个时点,因此,本论文的分析结果当然是对2009年 10月这个时点相关情况的反映。研究方法本论文考虑建立结构方程全模型来研究大学生预期就业手段和预期就业地域(内生潜变 量)与其各个因素(外生潜变量)之间的关系,并量化这种关系。结构方程模型的优
22、势就在 于引入潜变量(不可直接观测的量),使人们考虑问题的思路跃然纸上,显得更加系统化。也 就是,它以如下的方式考虑问题:外源观测变量 内生观测变量那么,研究外生潜变量对内生潜变量的影响实质上就是间接研究X指标对Y指标的影响。 只不过,结构方程把由同一个潜变量控制的指标划分为一类,表示这一类指标受该潜变量的 影响,使得问题的分析更加的系统。值得注意的是,本论文的研究基础一一问卷资料来自于第二方的调查资料,第二方事先 并未考虑过用结构方程模型分析问卷。那么,本文运用结构方程模型分析问卷,问卷中的问 题就不一定能很好地切合结构方程模型,由此可能引起相当的误差。这也就决定了我们在确 定运用结构方程模
23、型分析问卷时,已有心理准备面对模型可能出现的整体拟合效果不好等问 题,故本文着眼于推广结构方程模型建模方法在问卷分析中的应用。也就是说,欲用结构方 程模型分析问卷,应该事先根据相关理论或经验初步设定几个潜变量,然后在问卷中为每一 个潜变量设置若干的题目来测量它。2问卷数据的收集数据来源本论文数据来自于辽宁工程技术大学理学院2007级统计系本科生于2009年10月至11 月期间收集的题目为'大学生就业与深造意向调查”的原始问卷资料。该次调查的调查对象 为辽宁工程技术大学全日制在读本科生(辽宁工程技术大学二级学院的学生不包括在内)。具 体说来,本论文仅仅提取在问卷的“甄别问题”部分回答“就
24、业”的那部分人(共计280人) 的相关信息进行分析。抽样方法该次调查按学科类别(文科、理科、工科、其他)和年级(大一、大二、大三、大四) 将研究总体分为16个层,由于“其他类”的大一和大四的数据难以取得,因此,仅针对其余14个层进行抽样。根据抽样框,在每层中按简单随机抽样抽取20%的班级,同时在抽中的班 级中按简单随机抽样抽取30%的学生。问卷内容及执行情况调查问卷详见附录三。该次调查专门成立调查组,按照被抽中学生的花名册由专人负责发放问卷,共计发放问 卷788份,实际收回问卷758份,提取有效问卷706份。3问卷数据的处理定性变量的分类及赋值方法二项分类变量:无序分类变量多项分类变量:比如性
25、别(男,女),常赋值为0, 1或1, 2;比如学科类别(工,文,理),常赋值为1, 2, 3,,仅表示类别,无实际意义(所分类别或属性之间无程度或顺序的差别。)有序分类变量:比如满意度按非常不满意、不满意、一般、满意、非常满意分类, 常赋值为1, 2, 3,,注意要等间距,表示程度的递进或顺序 的递增(递减)。(所分类别之间有程度的差别。)本文变量的设置表1指标的设置变量符号变量名取值情况XI生源地Xl=l西部;Xl=2中部;XI二3东部X2户口类型X2=0农村户口 ; X2=l城镇户口X3父亲受教育程度X3=4初中以下;X3=2初中;X3=3高中或中专X3=4大专或本科;X3=5研究生以上X
26、4母亲受教育程度X4=l初中以下;X4=2初中;X4=3高中或中专X4=4大专或本科;X4=5研究生以上X5月可支配生活费X5= 1 300 元以下;X5=2 300'500 元X5=3 500、800 元;X5=4 800 元以上X6对就业形势的看法X6=l很不好;X6=2不好;X6二3 般X6=4较好;X6=5非常好X7所学专业前景看法X7=l很不好;X7=2不好;X7=3 一般X7=4较好;X7=5非常好X8参加就业辅导的次数X8二0参加0次;X8二1参加1次X8=2参加2次;X8二3参加4次以上X9就业资格证书个数X9二0. 1. 2、3X10四、六级考证情况XI0=0四、六级
27、都没过;X10二1过四级;X10=2过六级XII参加社会实践次数XI 1=0从不参加;XII二1参加1、2次XI 1=2参加3、4次;Xll=3参加4次以上Y1是否自主创业Yl=0 否;Yl=l 是Y2工作地域Y2=l农村地区;Y2=2县级地区Y2=3地级城市及州市;Y2=4省会城市及直辖市表2潜变量的设置n号 符 量 变名 量 变外生潜变量X5%4 X、X3X211 X25X8>X7X6311XI O11 XX9内生潜变量11 Y2Y24.基于结构方程模型的大学生预期就业手段和就业区域情况 分析结构方程模型简介很多社会、教育、心理等研究中涉及的变量,都不能准确、直接地测量,比如学习动机
28、、 家庭社会经济地位等,我们称这样的变量为潜变量。潜变量往往只能通过一些外生指标去衡 量,比如用父母受教育程度、学生户口类型、父母收入等外生指标来衡量学生的社会经济地 位(潜变量)。传统的统计分析方法不能妥善处理这些潜变量,而结构方程全模型则能同时处 理潜变量及其指标。它是一种基于变量的协方差矩阵来分析多个变量之间关系的一种统计方 法,也称为协方差结构分析。并且,它有机地整合了多元统计中的因子分析方法、生物学中 的路径分析方法以及计量经济学中的联立方程模型。结构方程全模型由测量方程和结构方程 组成。若结构方程模型中只包括测量方程,则又称为验证性因子模型。关于测量方程和结构 方程的形式,最普遍的
29、情况是设定为线性模型。(4.1)测量方程用来描述指标与潜变量之间的关系,用下述模型表示:Yn=AYf + s这里,X =(XPX2兀”),是|1|加个外生指标构成的列向量;疳=(岳,纟2,,即'是山“个外生潜变量构成的列向量;役是一个加X"维的矩阵,称作X在歹上的因子负荷阵, 描述了外生指标与外生潜变量之间的关系;是加维的误差项列向量。Y = ('Py2儿)?是山n个内生指标构成的列向量; =(1,是由卩个内生变量构成的列向量;外是一个维的矩阵,称作丫在°上的因子负荷阵,描述了内生指 标与内生潜变量之间的关系;£二(习,习,,為)是"维的
30、误差项列向量。结构方程用来描述外生潜变量与内生潜变量之间的关系,用下述模型表示:;7 = B;7 + r + y(4.2)这里,“、纟同上定义;B是一个uxu维的矩阵,描述内生潜变量之间的关系;是 一个-X“的矩阵,是“在歹上的负荷,描述外生潜变量对内生潜变量的影响;/ =,兀丫为一个卩维结构模型残差项列向量,反映了模型中未能解释的部分。模型的基本假定一般假定,每一个指标兀,兀(i = l,2,.,?;J = l,2,.,“)只在其对应的潜变量上有不为0 的因子负荷,而在其他潜变量上的因子负荷为0。内生变量之间的路径(相关或单方面影响) 依据经验和相关理论而定。测量误差项0与外生潜变量
31、9;之间(门= 1,2,冲)、测量误差项®与内生潜变量竹之间不相关(i、j = 2m);迓与巧(心= 1,2,"心j)、习与巧(fj = 12/;i工j)、兀与力(门=12冲H J)不相关。结构方程模型路径图及形式结合研究目的,首先我们根据相关研究及经验,找出影响大学生的预期就业手段和预期 就业地域这两个内生潜变量的外生潜变量。然后,对问卷中的相关指标进行初步归类,建立 验证性因子模型,并进行相关的参数估计、不断修正,最终确定潜变量的结构后,再加入结 构方程模型。下图为拟釆用的结构方程全模型的路径分析图,欲对各路径参数进行估计。图1拟采用的全模型路径分析图图1的符号说明:正
32、方形或长方形表示指标;圆或椭圆表示潜变量;单向箭头表示单向影响;双箭头表示相关;单向箭头指向指标表示测量误差;单向箭头指向潜变量表示內生潜变量未被解释的部 分。注意:确定需要用哪些指标衡量潜变量,可以根据经验分析进行初步归类,也可以使用多元统 计分析中因子分析的方法进行探索。然后,对初步归类的指标建立验证性因子模型(即只有 测量方程),并进行相应的参数估计,比较从属于同一潜变量的各路径参数的大小,进行相应 的路径删减。结构方程全模型是否可识别不仅取决于数据质量,更取决于模型设定形式是否正确。模 型形式的正确性就表现在潜变量指向指标的单向路径、外生潜变量之间的双向路径、内生潜 变量之间的单向或双
33、向路径、外生潜变量指向内生潜变量的单向路径划定是否正确。每一条 路径对应一个待估参数(主要是模型中的系数(负荷)、误差方差、潜变量之间的相关系数)。 一般的思路是先建立验证性因子模型,不断修正(删减路径或改变路径相连方式)、保证指标 与潜变量之间的从属关系成立后,再建立结构方程,不断修正,渐渐修改为相对理想的模型。在没有任何理论依据或经验的前提下,我们要考虑任意两个外生潜变量之间、任意两个 內生潜变量之间的相关关系(路径为双向),然后根据模型的参数估计结果进行相应的路径增 减。由图1,注意到本文拟采用的模型中,两个内生潜变量弘和仏均分别只用一个指标X和岭 衡量,相当于潜变量就是指标。原则上,结
34、构方程模型并不允许这样的情况出现,因为单指 标潜变量的存在会使得模型无法识别。倘若这种情况真的出现了,需在参数估计时固定负荷 或方差等(详见附录四的程序)。本文模型的设定形式不得不包含单指标的潜变量,主要是由 于我们基于第二方设计的问卷进行相关问题的分析,使得问卷内容设计和模型形式设定脱节, 从而导致有些潜变量找不到一定数量的、合适的指标来测量。对照图1,模型的形式设定为:务+G丿(1)实际上,由于内生潜变量%为单指标潜变量,久也2就是h无需估计, 因而也就不存在误差项吕,£2 o(3)ro+ 011 012 03、 d忽023丿模型的识别常用/-法则判断模型是否可识别:在结构方程模
35、型(4.1)-(4.2)中,共有伽+幵)个可观 测变量,记f为模型中自由估计的参数个数,则模型可识别的一个必要条件是: t < (in + n)(m + n + 1)/2该模型中共含有35个参数,包括11个负荷、3个潜变量之间的相关系数、11个观测变 量的误差方差、结构模型的8个未知参数、2个内生潜变量的误差方差。由于 35513x14/2 = 91,故该模型可识别。模型的参数估计以及参数的显著性检验1、模型的参数估计利用结构方程模型软件对模型的未知参数进行估计,源程序、输出结果分别见附录四和 附录五。结构方程模型参数估计的基本思想是:求参数使得模型隐含的协方差矩阵与样本协方差 矩阵“差
36、距”最小。对这个矩阵之间"差距”的不同定义方法,产生了不同的模型拟合方法 及相应的参数估计。最常用的结构方程模型参数估计方法是极大似然函数法(ML),虽然此法 需要假定观测指标的分布为正态或近似正态分布,但很多研究表明,即使指标的分布不为正 态分布,IL方法也能得到合适的估计,尤其在大样本条件下。也即,ML估计是稳健的。2、模型参数的显著性检验的输出结果给出了未标准化情况下,各因子负荷的估计以及与各负荷相应的标准差估计 值和/-检验统计量值。一般可简单地取/值大于2为显著,即此时认为相应的负荷显著不为 0。若有某几个因子负荷不显著,每次取消一个路径,重新运行程序后,再进行负荷的显著性
37、检验,重复此过程,直到各个负荷均显著为止。的输出结果也给出了标准化情况下参数的估计结果。标准化情况下,参数估计结果不受 各指标或因子量纲的影响,便于对变量之间的相互关系进行分析。本文的模型采用标准化情况下的参数估计结果,并且分两步确立:第一步建立验证性因 子模型,确定潜变量的结构;第二步按照图1的模型(即加入结构方程),运行程序,删除不 显著的路径后再次运行程序,共经历两次路径删除后,估计结果显示所有的因子负荷在置信 水平a = 90%下,均已显著。从而得到本文估计模型的具体形式:0.40400、0.712000.76800飞、0.810003 X20.65300=00.5190+00.679
38、0< >< xl 1 >00.6340、51丿000.900000.42700.234 ,(2)X、P.9970)+62丿0.886,5丿丿(3)卩 1 = (° /J"(0.2545)<0.123 丿+0191(4.3)§+Y&3 )0.162 0.145"0 0丿此外,输出结果(见附录五)中没有包含违背常理的参数估计值,比如说没有出现方差小于 0、相关系数大于1等情况,说明用该模型拟合原始数据是合适的。模型的整体拟合评价根据结构方程模型中评价模型拟合优劣的相关理论,通常采用以下几种指标来评价模型 的拟合效果:相对拟合指数(CFI):取值于01之间,越接近于1,模型整体拟合越好;近似均方根误差指数(RMSEA):其值越小越好。一般认为,RMSEA低于表示好的拟合,低 于表示非常好的拟合。调整后的拟合优度指数(AGFI):取值于01之间,越接近1,模型整体拟合越好。本文模型的拟合优劣指标汇总如下:表3模型的拟合指数指标(丫 1RMSEAAGFI取值结合各个拟合指数的判断标准,由表1知,模型整体拟合效果一般。前述节的注意(4) 已分析过原因。模型参数估计结果的解释每一个观测指标对其从属的潜变量的标准化参数估计值(即负荷),有效地反映了该指标 与相应潜变量之间
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 数字营销2026年社交媒体营销协议
- 自动化控制系统开发合同协议
- 小微企业消防自查表
- 混凝土布料机浇筑施工工艺
- 2026年编导艺考模拟真题及答案和2026年考试真题
- 老旧矿区改造桩基新旧钢筋衔接处理做法
- 安全生产快板伴奏讲解
- 湖南省名校联盟2026-2027学年高三上学期开学考试生物试题(文字版含答案)
- 干细胞库建设项目可行性研究报告
- 消防安全九项规定题库
- 外研版英语七年级上册Starter单元试题(含答案)
- 汉字偏旁部首读法大全
- 2023年军转自荐信多篇
- 卫生部手术分级目录(2023年1月份修订)
- 电力工程专业设计工日定额9.26
- 初高中英语衔接初高中英语衔接-课件
- 电路分析基础:第八章 阻抗与导纳
- 企业清产核资工作底稿模板-会计师事务所
- 校园环境卫生检查及记录表
- 实验室产品测试标准流程
- (人教部编版)二年级上册语文课课练(全册)含答案
评论
0/150
提交评论