




已阅读5页,还剩27页未读, 继续免费阅读
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
.,1,第七章主成分分析,1、主成分分析2、SPSS上机实现过程,.,2,主成分分析,每个人都会遇到有很多变量的数据。这些数据的共同特点是变量很多,在如此多的变量之中,有很多是相关的。人们希望能够找出它们的少数“代表”来对它们进行描述。本章就介绍两种把变量维数降低以便于描述、理解和分析的方法:主成分分析(principalcomponentanalysis)和因子分析(factoranalysis)。实际上主成分分析可以说是因子分析的一个特例。,.,3,主成分分析(PrincipalComponentsAnalysis,PCA)也称为主分量分析,是一种通过降维来简化数据结构的方法,即如何把多个变量(变量)转化为少数几个综合变量(综合变量),而这几个综合变量可以反映原来多个变量的大部分信息。,什么是主成分分析,主成分分析,.,4,主成分分析就是设法将原来众多具有一定相关性的变量(如p个变量),重新组合成一组新的相互无关的综合变量来代替原来变量。怎么处理?通常数学上的处理就是将原来p个变量作线性组合作为新的综合变量。如何选择?如果将选取的第一个线性组合即第一个综合变量记为F1,自然希望F1尽可能多的反映原来变量的信息。怎样反映?,基本思想,.,5,最经典的方法就是用方差来表达,即var(F1)越大,表示F1包含的信息越多。因此在所有的线性组合中所选取的F1应该是方差最大的,故称之为第一主成分(principalcomponentI)。如果第一主成分不足以代表原来p个变量的信息,再考虑选取F2即第二个线性组合。F2称为第二主成分(principalcomponentII)。F1和F2的关系?,基本思想,.,6,为了有效地反映原来信息,F1已有的信息就不再出现在F2中,即cov(F1,F2)0。依此类推,可以获得p个主成分。因此,这些主成分之间是互不相关的,而且方差依次递减。在实际中,挑选前几个最大主成分来表征。标准?各主成分的累积方差贡献率80%或85%(根据实验结果和要求可以自己调整)或特征根1。,基本思想,.,7,.,8,.,9,.,10,.,11,.,12,上机操作流程,.,13,.,14,.,15,.,16,.,17,主成分分析的前提条件:原始变量之间有一定的相关性检验方法(1)Kaiser-Meyer-Olkin(KMO)检验:抽样充足量的测度,检验变量之间的偏相关系数是否过小。(2)Bartletts检验:该检验的原假设是相关矩阵为单位阵(不相关),如果不能拒绝原假设,则不适合进行主成分分析。,综合变量(主成分)之间互不相关,.,18,.,19,.,20,计算主成分特征根及贡献率和累积贡献率,如果想选取累积贡献率95%,则需要重新选择因子数,.,21,.,22,确定主成分,本操作是选择以特征根大于1为标准提取主成分,提取了2个主成分。按照累积方差的观点,应该提取80%或85%的值,本例题提取2个主成分,其累积方差贡献率为94.99,应该提取2个应该提取前两个主成分。,.,23,写出主成分模型,.,24,前面的表给出的因子载荷矩阵,主成分系数应该为特征向量,其换算方法为:用主成分载荷矩阵中的数据除以主成分相对应的特征值开平方根便得到两个主成分中每个指标所对应的系数。,.,25,.,26,.,27,.,28,第一主成分的特征值,.,29,.,30,第二主成分的特征值,.,31,.,32,主成分模型为:,F1主要表示X4、X5、X6、X7的信息(夏半年的信息),F1=0.337X1+0.34X2+0.347X3+0.22X4+0.102X5+0.084X6+0.156X7+0.322X8+0.344X9+0.34X10+0.328X11+0.337X12,F1主要表示X1、X2、X3、X8、X9、X10、X11、X12的信息(冬半年的信息),F2=-0.134X1-0.114X
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 湖南长沙雨花区雅境中学2026届九上化学期中联考试题含解析
- 2026届重庆八中学、九十五中学等学校化学九年级第一学期期中经典试题含解析
- 青川抽污水施工方案设计
- 河北省保定市清苑区北王力中学2026届九上化学期中教学质量检测试题含解析
- 高层过道清理方案范本
- 员工培训结交客户
- 装配生产工艺培训大纲
- 陕西省宝鸡岐山县联考2026届化学九上期中检测模拟试题含解析
- 2026届江苏省连云港市新海实验中学英语九年级第一学期期末学业水平测试试题含解析
- 2026届重庆市西南大附属中学化学九年级第一学期期末预测试题含解析
- 红火蚁监测和防控技术
- python程序设计-说课
- 虫害防治工作总结
- 【自考复习资料】05175税收筹划(重点知识汇总)
- 肺结核的临床诊断和治疗管理指南
- 大学美育(第二版) 课件 第五单元:书法艺术
- 计算机应用基础(Windows10+Office2016)(第3版) 课件 项目3、4 Windows10操作系统、管理计算机中的资源
- 《种子包衣技术》课件
- 《矿区水文地质工程地质勘探规范》水文地质单元及侵蚀基准面划分的探讨
- 高等计算机系统结构课件
- 海南自贸港测试题库(195道)
评论
0/150
提交评论