版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、1多元统计分析思考题答案记得老师课堂上说过考试内容不会超出这九道思考题,如下九道题题目中有错误的或不清楚的地方,欢迎大家指出、更改、补充。1、简述信度分析、简述信度分析答题提示:要答可靠度概念,可靠度度量,克朗巴除系数、拆半系数、单项与总体相答题提示:要答可靠度概念,可靠度度量,克朗巴除系数、拆半系数、单项与总体相关系数、稀释相关系数等(至少要答四个系数,至少要给出两个指标的公式)关系数、稀释相关系数等(至少要答四个系数,至少要给出两个指标的公式)答:答:信度(Reliability)即可靠性,它是指采用同样的方法对同一对象重复测量时所得结果的一致性程度。信度指标多以相关系数表示,大致可分为三
2、类:稳定系数(跨时间的一致性),等值系数(跨形式的一致性)和内在一致性系数(跨项目的一致性)。信度分析的方法主要有以下四种:1)、重测信度法这一方法是用同样的问卷对同一组被调查者间隔一定时间重复施测,计算两次施测结果的相关系数。重测信度属于稳定系数。重测信度法特别适用于事实式问卷,如果没有突发事件导致被调查者的态度、意见突变,这种方法也适用于态度、意见式问卷。由于重测信度法需要对同一样本试测两次,被调查者容易受到各种事件、活动和他人的影响,而且间隔时间长短也有一定限制,因此在实施中有一定困难。2)、复本信度法复本信度法是让同一组被调查者一次填答两份问卷复本,计算两个复本的相关系数。复本信度属于
3、等值系数。复本信度法要求两个复本除表述方式不同外,在内容、格式、难度和对应题项的提问方向等方面要完全一致,而在实际调查中,很难使调查问卷达到这种要求,因此采用这种方法者较少。3)、折半信度法折半信度法是将调查项目分为两半,计算两半得分的相关系数,进而估计整个量表的信度。折半信度属于内在一致性系数,测量的是两半题项得分间的一致性。这种方法一般不适用于事实式问卷(如年龄与性别无法相比),常用于态度、意见式问卷的信度分析。在问卷调查中,态度测量最常见的形式是5级李克特(Likert)量表。进行折半信度分析时,如果量表中含有反意题项,应先将反意题项的得分作逆向处理,以保证各题项得分方向的一致性,然后将
4、全部题项按奇偶或前后分为尽可能相等的两半,计算二者的相关系数。为 了 校 正 差 异 , 两 半 测 验 的 方 差 相 等 时 , 常 运 用 斯 皮 尔 曼-布 朗 公 式(Spearman-BrownFormula):rxx=2rhh/(l+rhh),其中,rhh:两半测验的相关系数;rxx:估计或修正后的信度。该公式可以估计增长或缩短一个测验对其信度系数的影响。当两半测验的方差不同时,应采用卢伦公式(RulonFormula)或弗拉纳根公式(FlanaganFormula)进行修正。4)、a 信度系数法Cronbacha 信度系数是目前最常用的信度系数,其公式为:Si21gS2其中,s
5、?为每一项目的方差;sx2为测验总分方差。从公式中可以看出,a 系数评价的是量表中各题项得分间的一致性,属于内在一致性系数。这种方法适用于态度、意见式问卷(量表)的信度分析。22、简述多元尺度分析在你工作中的应用、简述多元尺度分析在你工作中的应用答:答:多元尺度分析(Multi-dimensionAnalysis)是市场研究的一种有力手段,是市场调查、分析数据的统计方法之一。它可以通过低维空间(通常是二维空间)展示多个研究对象(比如品牌)之间的联系,利用平面距离来反映研究对象之间的相似程度。由于多维尺度分析法通常是基于研究对象之间的相似性(距离)的,只要获得了两个研究对象之间的距离矩阵,我们就
6、可以通过相应统计软件做出他们的相似性知觉图。在实际应用中,距离矩阵的获得主要有两种方法:一种是采用直接的相似性评价,先对所有评价对象进行两两组合,然后要求被访者对所有的这些组合间进行直接相似性评价,这种方法我们称之为直接评价法;另一种为间接评价法,由研究人员根据事先经验,找出影响人们评价研究对象相似性的主要属性,然后对每个研究对象,让被访者对这些属性进行逐一评价,最后将所有属性作为多维空间的坐标,通过距离变换计算对象之间的距离。多维尺度分析的主要思路是利用对被访者对研究对象的分组,来反映被访者对研究对象相似性的感知,这种方法具有一定直观合理性。在工作中,通过多维尺度分析,可以将消费者对商品相似
7、性的判断产生一张能够看出这些商品间相关性的图形。例如:有十个百货商场,让消费者排列出对这些百货商场两两间相似的感知程度,根据这些数据,用多维尺度分析,可以判断消费者认为哪些商场是相似的,从而可以判断竞争对手。用于反映多个研究事物间相似(不相似)程度,通过适当的降维方法,将这种相似(不相似)程度在低维度空间中用点与点之间的距离表示出来,并有可能帮助识别那些影响事物间相似性的潜在因素。这种方法在市场研究中应用得非常广泛。3、简述两个变量之间的相关分析答题提示:答什么是相关,对连续型变量用相关系数,对、简述两个变量之间的相关分析答题提示:答什么是相关,对连续型变量用相关系数,对离散型变量用质相关系数
8、离散型变量用质相关系数答:答:相关分析(correlationanalysis),研究随机变量之间的相关关系的一种统计方法。相关关系是一种非确定性的关系。相关性探讨的是两变量间相关情况的的大致趋势。相关分析涉及两个变量:应变量和自变量。应变量(responsevariable)是度量研究结果的变量;自变量是解释或影响反应变量的变量。两变量数据相关检验的步骤:一、图示两变量数据以及各个统计数字;二、查看整体状态及数据的离散情况;三、如果有较稳定的关系,就用简单的数学模式描述该关系。对连续型变量常用相关系数刻画两个变量之间的相关性,而对离散型变量则用质相关系数。34、聚类和判别分析的异同、聚类和判
9、别分析的异同答答: :聚类分析是把研究目标分割成为具有相同属性的小的群体。对变量的聚类称为 R 型聚类,而对观测值聚类称为 Q 型聚类。它们在数学上是无区别的。聚类的基本想法:根据某种距离,把最近的聚在一起。这里的距离含义很广,如欧氏距离、马氏距离等距离,相似系数也可看作为距离。判别分析的基本思路是:设有 Gl、G2、GK 个总体,从不同的总体中抽出不同的样本,根据样本一建立判别法则一判别新的样品属于哪一个总体。当然,根据不同的方法,建立的判别法则也是不同的。常用的判别方法有:距离判别、Fisher 判别、Bayes 判别。判别分析和聚类分析都是分类。其主要不同点就是,在聚类分析中一般人们事先
10、并不知道或一定要明确应该分成几类,完全根据数据来确定。而在判别分析中,至少有一个已经明确知道类别的“训练样本”,利用这个数据,就可以建立判别准则,并通过预测变量来为未知类别的观测值进行判别了。可以先聚类以得知类型,再进行判别.5、因子分析和主成分分析的异同、因子分析和主成分分析的异同答答:主成分分析和因子分析是多元统计方法中关系密切的两种方法,应用范围十分广泛,可以解决经济、教育、科技、社会等领域中的综合评价问题。主成分分析采用降维的思想,将研究对象的多个相关变量(指标)综合为少数几个不相关的变量,反映原变量提供的主要信息。因子分析是主成分分析的推广和发展,它将具有错综复杂关系的变量综合为数量
11、较少的几个因子,以再现原始变量与因子之间的相互关系,同时根据不同因子还可以对变量进行分类,它属于多元分析中处理降维的一种统计方法。但是,在许多论文中用 SPSS 进行综合分析时,出现这两种方法运用混淆的错误。比如,主成分分析中对变量进行了因子旋转,因子分析的公因子系数错误等问题。本文就此对主成分分析和因子分析的异同进行比较,并在SPSS 和 DPS 软件上如何实现给予说明。一、主成分分析与因子分析的异同点两者的相同点:1、思想一致:都是降维的思想;2、应用范围一致:都要求变量之间具有不完全的相关性;3、数据处理过程一致:数据的无量纲化,求相关系数矩阵的特征值和特征向量,通过累计贡献率确定主成分
12、个数、因子个数;4、合成方法一致:都没有考虑原始变量之间的关系,直接用线性关系处理变量与主成分和因子之间的关系。两者的不同点:1、方差损失上:主成分解释了原始变量的全部方差,无方差损失;因子模型中除了有公因子外还有特殊因子,公因子只解释了部分信息,有方差损失;2、唯一性:主成分分析不存在因子旋转,主成分是唯一的;因子分析进行因子旋转,解不唯一;3、实际意义:主成分没有实际意义;公因子有实际意义;4、应用:主成分侧重信息贡献、影4响力综合评价;因子分析侧重成因清晰性的综合评价。1. 因子分析中是把变量表示成各因子的线性组合,而主成分分析中则是把主成分表示成几个变量的线性组合。2. 主成分分析的重
13、点在于解释个变量的总方差,而因子分析则把重点放在解释各变量之间的协方差。3主成分分析中不需要有假设(assumptions),因子分析则需要一些假设。因子分析的假设包括:各个共同因子之间不相关,特殊因子(specificfactor)之间也不相关,共同因子和特殊因子之间也不相关。4.主成分分析中,当给定的协方差矩阵或者相关矩阵的特征值是唯一的时候,的主成分一般是独特的;而因子分析中因子不是独特的,可以旋转得到不到的因子。5在因子分析中,因子个数需要分析者指定(spss 根据一定的条件自动设定,只要是特征值大于 1 的因子进入分析),而指定的因子数量不同而结果不同。在主成分分析中,成分的数量是一
14、定的,一般有几个变量就有几个主成分。和主成分分析相比, 由于因子分析可以使用旋转技术帮助解释因子, 在解释方面更加有优势。大致说来,当需要寻找潜在的因子,并对这些因子进行解释的时候,更加倾向于使用因子分析,并且借助旋转技术帮助更好解释。而如果想把现有的变量变成少数几个新的变量(新的变量几乎带有原来所有变量的信息)来进入后续的分析,则可以使用主成分分析。当然,这中情况也可以使用因子得分做到。所以这中区分不是绝对的。总得来说,主成分分析主要是作为一种探索性的技术,在分析者进行多元数据分析之前,用主成分分析来分析数据,让自己对数据有一个大致的了解是非常重要的。主成分分析一般很少单独使用:a,了解数据
15、。(screeningthedata),b,和 clusteranalysis 一起使用,c,和判别分析一起使用,比如当变量很多,个案数不多,直接使用判别分析可能无解,这时候可以使用主成份发对变量简化。(reducedimensionality)d,在多元回归中,主成分分析可以帮助判断是否存在共线性(条件指数),还可以用来处理共线性。在算法上,主成分分析和因子分析很类似,不过,在因子分析中所采用的协方差矩阵的对角元素不在是变量的方差,而是和变量对应的共同度(变量方差中被各因子所解释的部分。)。6、系统聚类与、系统聚类与K-means聚类的基本原理聚类的基本原理答:答:系统聚类法基本原理和步骤为
16、:1、先计算 n 个样本两两间的距离2、构造 n 个类,每个类只包含一个样本3、合并距离最近的两类为一新类4、计算新类与当前各类的距离5、类的个数是否等于 1,如果不等于回到 3 在做6、画出聚类图57、决定分类个数和类K-means 聚类的基本原理:聚类可以走着瞧,不一定事先确定有多少类;但是 K-means 聚类却要求先说好要分多少类。看起来有些主观。假定分 3 类,这个方法还进一步要求你事先确定 3 个点为“聚类种子”(多数软件会自动选种子);也就是说,把这 3 个点作为三类中每一类的基石。然后根据和这三个点的距离远近,把所有点分成三类。再把这三类的中心(均值)作为新的基石或种子(原来“
17、种子”就没用了),再重新按照距离分类。如此叠代下去,直到达到停止叠代的要求(比如,各类最后变化不大了,或者叠代次数太多了)。显然,前面的聚类种子的选择并不必太认真,它们很可能最后还会分到同一类中呢。7、Fisher判别和贝叶斯判别的基本原理判别和贝叶斯判别的基本原理答:答:Fisher 判别法是一种先投影的方法。 使多维问题简化为一维问题来处理。 选择一个适当的投影轴,使所有的样品点都投影到这个轴上得到一个投影值。对这个投影轴的方向的要求是:使每一类内的投影值所形成的类内离差尽可能小,而不同类间的投影值所形成的类间离差尽可能大。进行投影后,再根据距离判别思想由距离的远近得到判别准则,从而进行判
18、别分析。贝叶斯(BAYES)判别思想是根据先验概率求出后验概率,并依据后验概率分布作出统计推断。所谓先验概率,就是用概率来描述人们事先对所研究的对象的认识的程度;所谓后验概率,就是根据具体资料、先验概率、特定的判别规则所计算出来的概率。它是对先验概率修正后的结果。8、举例说明你在工作中如何应用主成分分析和因子分析、举例说明你在工作中如何应用主成分分析和因子分析(因主成分分析有什么什么缺点,可用因子分析什么什么旋转(因主成分分析有什么什么缺点,可用因子分析什么什么旋转)答:答:主成分分析:将多个变量通过线性变换以选出较少个数重要变量的一种多元统计分析方法。在分析问题的时候,往往提出很多有关的变量
19、来描述一个事物,在宏观经济研究领域中,表述国家基本经济面貌的时有很多指标,如人口、国土面积、公路里程、GDP、财政收入等等。在对人的描述的时候,有身高、体重、学历、年龄、工作等多项可直接测量的指标。众多的指标中,有很多是相互关联的,不能清晰的反应数据问题,人们希望能将这些指标进行高度概括,用有限的指标精炼的概括,清晰地反应数据全貌。将原有变量重新组合成几个相互无关的新变量,同时根据实际从中选出较少的变量尽可能多地反映原有变量统计信息,在数学上也叫做降维处理。当我们展开区域竞争力研究的时候,可以利用主成分分析法。首先要根据区域竞争力选6择适合的指标体系,以综合竞争力开展的研究的指标体系如:国内生
20、产总值(GDP)、第三产业比重、工业占第二产业比重、邮电业务总量、用电量、全社会固定资产投资、外商直接投资、科学研究等。取得 31 个省(市、自治区)的数据。对原始指标数据的标准化采集 p维随机向量 x=(X1,X2,.,Xp)T),31 个样品 xi=(xi1,xi2,.,xip)T,i=1,2,:31,由于指标间量纲不同, 将数据进行标准化操作。 求的相关系数矩阵 R 的特征方程及 p 个特征根,及特征向量。将标准化的指标量转化成主成分,并根据特征根的大小确定主成分贡献率,将前n 个主成分累计贡献率超过 85%对各个样本的权系数重新组合,计算各个样本在 n 个主成分上的得分,根据得分将不同
21、地区划成不同的组合,这样就可以将原有因指标众多而无法分清的地区间区别,可以通过有限个主成分将各地区区分出来,将竞争力相近的地区主成分得分基本靠近,几何做图的意义是,在主轴上的各样本点分别集中在各自的主轴附近。进一步分析各个主轴的经济学含义。完成主成分分析。因子分析:它的目的在于研究原始变量的内部关系,通过寻找变量的共同因素来简化和分析变量中存在的复杂关系。它把每个变量分解为两部分因素,一部分是由这些变量内含的共同因素所构成,即所谓公共因素部分,另一部分是每个变量各种独有的因素,即所谓独特因素或单一因素部分。仍然沿用对地区竞争力分析的案例,由于根据主成分分析得到的 n 个主成分,将多个指标投影到
22、少量的主成分之上,简化了数据结构,但仍然无法明确主成分的含义,也无法明确指标间的关系。这样利用因子分析,将各个变量中的公共因子找到,也就是造成地区间竞争力不同的的共性因素,同时找到各地区不同的独特因素。首先对各省数据进行标准化处理。根据正交因子模型:X=u+A*F+&,其中 F 为 X 的公共因子,&为 X 的特殊因子,A 为因子载荷矩阵。根据标准化数据计算协方差阵,并且求的其特征根和标准化特征向量,确定 m 个方差累积贡献率达到 85%以上的公因子个数。由于公因子解不唯一,为了取得更好对公因子的经济学解释,对公因子进行方差最大的正交旋转,将各列载荷向 0 或 1 两极方向分化,将大大有利于对公因子进行解释。本案例中,得到 2 个公因子,gdp 等指标在第一公因子上的载荷比较高,可以将第一公因子解释为经济层面的硬件因素,而教育投入、科研投入等指标在第二公因子上载荷较高,可以将第二公因子解释为软件因素。最后还可以将公因子反过来表示为不同变量的线性组合,即得到每个样本(每个省)的因子得分,来判断各个省在两个公因子的得分情况,清晰的看到有些省份在两个公因子的得分都很到,有的部分得分高,有的都很低,体现出东、中、西部的差距,与人们普遍感受是一致的。同时根据地区间差距,找到具体得分差在哪里,对今后该地区提高综合竞争力有很好的
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 校园欺凌培训相关试题及答案
- 消防检测考试常见试题与答案
- 办保安证各类试题及完整答案
- 2025-2026学年廊坊市安次区数学四下期中统考试题含答案解析
- 北斗监控测试题及参考答案
- 会计招聘笔试题及参考答案
- 35MW碲化镉光伏发电玻璃示范项目可行性研究报告模板立项申批备案
- 2026年汽车经销商客户关系管理系统升级案例
- ISO 12003-12021 农林拖拉机.窄拖拉机上的防滚翻保护结构.第1部分前装式ROPS标准立项发展报告
- 2026年天津市公务员考试行测数量关系专项训练课件
- 2026年数字安徽有限责任公司所属企业安徽数安系统集成有限公司第1批次社会招聘考试参考题库及答案详解
- 2026年中小学教师(语文)副高级职称评审答辩题库及答案
- 学校管理与教师专业发展手册
- 2026秋新人教版英语五年级上册单元一Unit 1 Different friends测试卷-提高卷附答案(文档中已插入听力音频)
- 2026-2030中国白垩工业市场现状分析与竞争策略研究报告版
- 2026广西南宁市青秀区伶俐镇人民政府招聘2人(劳务派遣)笔试参考题库及答案详解
- 2026福建泉州交发集团(第一批)校园招聘89人笔试备考题库及答案详解
- 2026年新疆生产建设兵团事业单位考试真题及答案
- 2026年广东省中考语文试卷(含详细答案解析)
- 影像医学技术操作规程大全
- 2026年河南高考地理考试试卷及答案
评论
0/150
提交评论