主成分分析与经验正交分解课程_第1页
主成分分析与经验正交分解课程_第2页
主成分分析与经验正交分解课程_第3页
主成分分析与经验正交分解课程_第4页
主成分分析与经验正交分解课程_第5页
已阅读5页,还剩52页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、第5章主成分分析与经验正交分解5.1 主分量分析的数学模型当存在若干个随机变量时,寻求它们的少量线性组合(即主成分),用以解释这些随机变量,是很必要的。首先我们看一个例子。例51 为了调查学生的身材状况,可以测量他们的身高()、体重()、胸围()和坐高()。可是用这4个指标表达学生身材状况不方便。但若用=3.6356+3.3242+2.4770+2.1650表示学生身体魁梧程度;用=-3.9739+1.3582+3.7323-1.5729表示学生胖瘦程度。则这两个指标(,)很好概括了4个指标(-)。例中,学生不同,身高()、体重()、胸围()和坐高()不同;(, , , )是4维随机向量;,是

2、他们的2个线性组合,,能很好表示, , , 的特性。类似的问题在许多地方出现:可观测的随机变量很多,需要选出所有所有随机变量的少数线性组合,使之尽可能刻划全部随机变量的特性,选出的线性组合就是诸多随机变量的主成分,又称为主分量。寻求随机向量主成分,并加以解释,称为主成分分析,又称为主分量分析。主成分分析在许多学科中都有应用,细节可参看张尧廷(1991)、Richard(2003),主成分分析在气象等科学中称为PCA方法,见吴洪宝(2005)。主成分分析的数学模型是:对于随机向量X,想选一些常数向量,用尽可能多反映随机向量X的主要信息,也即尽量大。但是的模可以无限增大,从而使无限变大,这是我们不

3、希望的;于是限定模的大小,而改变各分量的比例,使最大;通常取的模为1最方便。定义5.1 设随机向量二阶矩存在,若常数向量,在条件1下使最大,则称是X的第一主成分或第一主分量。由定义可见,尽可能多地反映原来p个随机变量变化的信息。但是一个主成分往往不能完全反映随机向量特色,必须建立其它主成分,它们也应当最能反映随机向量变化,而且他们应当与第一主成分不相关(不包含的信息)。定义5.2 若常数向量c=在条件l,下,使最大,则称是 X的第二主成分;若常数向量c=在条件l,下,使最大,则称是 X的第三主成分;。当随机向量方差已知时,定理5.1给出主成分的计算公式。定理5.1 设随机向量方差存在为。特征值

4、从大到小为,对应的彼此正交单位特征向量为。则X的第j个主成分为 与X的内积,即 (5.1)且证明:任取p维单位向量c,必有。于是,而在条件下,当,即时,最大,所以X的第一主成分是与X的内积。由条件,可得,于是,从而;所以在条件1、下,当时,最大,所以X的第2个主成分为与X的内积。对第三,第四主成分同样可证。由证明过程可见:。它称为第i个主成分的方差贡献,表示第i个主成分变化大小,从而反映第i个主成分提供的信息的大小。例5.2 设,且则=3.87939,=0.293128,-0.84403,-0.449099=1.6527,=0.449099,-0.293128,0.84403=0.467911

5、,=0.84403,0.449099,-0.293128所以第一主成分就是=0.293128-0.84403 -0.449099;第二主成分就是=0.449099-0.293128+0.84403;第三主成分就是=0.84403+0.449099-0.293128。它们的方差贡献分别是;。定义5.3 称为主成分的方差贡献率;称为前k个主成分的累计方差贡献率;与X第k个分量的相关系数称为因子负荷量。当某个主成分的方差贡献率很小时,认为它提供的信息很少,可以略去此主成分。通常取q,使前q个主成分的累计方差贡献率达到70%-80%,然后只考虑前q个主分量,用它们解释随机向量X的特性,其余主成分认为是

6、观测误差等随机因素造成的。在实际问题中,X的每一分量可取不同单位,单位取小时(例如长度单位取毫米,甚至微米)该分量的方差会变大,从而在主成分中变得突出;而单位选取不应影响主成分。为了避免量纲对主成分的影响。常常将随机变量都标化,即令,它就是无量纲量,令再求X*的主成分,即标准化后的主成分。将代入,可求随机向量X的主成分。容易证明定理5.2 设随机向量X的相关阵为,特征值为,对应的彼此正交单位特征向量为,则标准化后X的第j个主成分是。因此,标准化后的主成分称为由相关阵决定的主成分。直接由随机向量的协方差阵算出的主成分称为由协差阵决定的主成分。同样一组随机变量,用它们的协差阵和相关阵求出的主成分是

7、不一样的。这是因为优化的准则(目标函数)不同:前者要求=最大,而后者要求=最大,其中。例5.3 (协差阵和相关阵决定的主成分不同)设随机变量;其协方差阵是,特征值和特征向量是, 。因而由协方差阵决定的主成分是: ,。但随机变量标准化后得到;其中 。X*的协差阵即X的相关阵是,其特征值和特征向量是,从而由相关阵决定的主成分是:。由于主成分由方差决定,可以略去常数,因而由相关阵得到的主成分可写为:,可见由协方差阵与相关阵决定的主成分不同。5.2 样本主成分及其计算5.2.1 样本主成分实际问题中随机向量的协差阵、相关阵都是未知的,只能得到样品。这时总用样本协差阵与样本相关阵代替协差阵、相关阵求主成

8、分。定义5.4 样本协差阵与样本相关阵的特征向量,计算主成分。所得的主成分称为样本主成分。这样求主成分是有道理的:若总体,的特征值和正交单位特征向量是和;是的极大似然估计,即。的特征值为,相应正交单位特征向量为,则可证定理5.3 若X服从正态分布,则是的极大似然估计;是的极大似然估计。因此,若X服从正态分布,应当用第j个样本主成分作为总体主成分的估计值。从样本协差阵或样本相关阵出发,做主成分分析,所得样本主成分通常简称为主成分。通常取为样本协差阵(的无偏估计),由或R算出的样本相关阵是相同的,所产生(相关差阵决定)的主成分当然相同。而R与有相同的特征向量,R的特征值是特征值的n/(n-1)倍。

9、因而由R与所产生的(协方差阵决定的)主成分相同。若X不一定服从正态分布,这时仍可由样本协差阵R或相关阵出发,计算主成分。同上节指出的一样:样本相关阵和样本协差阵决定的主成分是不同的。 SAS软件计算样本主成分样本主成分的计算量很大,通常用软件计算,以下介绍用SAS软件计算的基本方法。SAS调用PRINCOMP过程(即主成分过程)作主成分分析。PROC PRINCOMP 过程对输入资料文件执行主成分分析。其输入资料文件可以是原始数据,也可以是一个相关系数矩阵,或是协方差阵。输出资料则包括特征根、特征向量及标准化的主成分值。主成分分析是一个多变量统计程序,可用来鉴定多个数值变量之间的关系。主成分分

10、析除了用来概述变量之间的关系外,还可用来削减回归或集群分析中变量的数目。它的主要目的是求出一组变量的线性组合(即主成分),这些线性组合就是原变量矩阵的特征向量。每个向量的内积就是该向量对原变量群能解释的方差百分比。这些特征向量之间应该是彼此线性独立的。PROC PRINCOMP语法 PROC PRINCOMP DATA= SAS-data-set /*输入资料文件名称*/ OUT= SAS-data-set /*输出资料文件名称*/ OUTSTAT= SAS-data-set /*输出资料文件名称*/ NOINT COVARIANCE(COV) N= n STANDARD(STD) PREFI

11、X= name NOPRINT SINGULAR= value VARDEF= DF|N|WEIGHT|WDF; 或N,或WGT,或WDF) VAR variable-list; /*指明那些数值变量作主成分分析*/ PARTIAL variable-list; FREQ variable; WEIGHT variable;BY variable-list;调用PRLNCOMP过程时常用两个语句:即PROC PRINCOMP ,VAR。(1) PROC PRINCOMP语句。一般形式是 PROC PRINCOMP;其功能是调用PRINCOMP过程。加选项cov指示电脑用协差阵计算样本主成分,不

12、加选项cov则电脑用相关阵计算主成分;加选项out=文件名,指示电脑将每个观测的主成分得分存入一个数据集,即“文件名”所表示的数据集,加选项n=k指示电脑只计算k个主成分,不加选项n=k则电脑计算全部p个主成分。例如proc princomp data=wang1 out=wang2 n=3;指示电脑对数据集wang1中数据做主成分分析,求3个主成分,并将各次观测的主成分得分存入数据集wang2。(2) VAR语句其功能是规定要分析的变量。例如var x1-x3 u1 v2;表示将变量x1,x2,x3,u1,v作为随机向量进行主成分分析。 计算主成分固然重要,解释主成分的意义更重要。下面我们介

13、绍用SAS作主成分分析的实例,并对于算出的主成分加以解释,希望学者对练习题中的主成分也试作解释。例5.4 北京19511976年冬季的气温资料如表5-1,第一列为年度,第二列为该年12月的月平均温度。第三、四列为次年1、2月的月平均温度。试做主成分分析。表 5-1 北京19511976年冬季月平均气温yearx1x2x319511.0-2.7-4.31952-5.3-5.9-3.51953-2.0-3.4-0.81954-5.7-4.7-1.11955-0.9-3.8-3.11956-5.7-5.3-5.91957-2.1-5.0-1.619580.6-4.3-0.21959-1.7-5.72

14、.01960-3.6-3.61.31961-3.0-3.1-0.819620.1-3.9-1.11963-2.6-3.0-5.21964-1.4-4.9-1.71965-3.9-5.7-2.51966-4.7-4.8-3.31967-6.0-5.6-4.91968-1.7-6.4-5.11969-3.4-5.6-2.01970-3.1-4.2-2.91971-3.8-4.9-3.91972-2.0-4.1-2.41973-1.7-4.2-2.01974-3.6-3.3-2.01975-2.7-3.70.11976-2.4-7.6-2.2解:因为所有变量单位相同,可用协方差阵求主成分。以变量ye

15、ar Dec Jan Feb分别表示年度、12月、1月、2月的温度。采用下列程序data temperat; /*建立数据集temperat*/input year Dec Jan Feb; /*建立变量year、Dec、Jan和Feb*/cards; /*以下为数据体*/1951 1.0 -2.7 -4.31952 -5.3 -5.9 -3.51953 -2.0 -3.4 -0.81954 -5.7 -4.7 -1.11955 -0.9 -3.8 -3.11956 -5.7 -5.3 -5.91957 -2.1 -5.0 -1.61958 0.6 -4.3 -0.21959 -1.7 -5.

16、7 2.01960 -3.6 -3.6 1.31961 -3.0 -3.1 -0.81962 0.1 -3.9 -1.11963 -2.6 -3.0 -5.21964 -1.4 -4.9 -1.71965 -3.9 -5.7 -2.51966 -4.7 -4.8 -3.31967 -6.0 -5.6 -4.91968 -1.7 -6.4 -5.11969 -3.4 -5.6 -2.01970 -3.1 -4.2 -2.91971 -3.8 -4.9 -3.91972 -2.0 -4.1 -2.41973 -1.7 -4.2 -2.01974 -3.6 -3.3 -2.01975 -2.7 -3

17、.7 0.11976 -2.4 -7.6 -2.2; /*空语句,结束数据体*/proc princomp cov; /* 用协差阵做主成分分析*/var Dec Jan Feb; /* 对变量Dec Jan Feb 作主成分分析*/run; 执行上述程序,得到得许多表,主要的是:基本统计量(Simple Statistic);协方差矩阵(Covariance Matrix);样本协差阵的特阵值表(Eigenvalues of the Covariance Matrix)、方差贡献、方差贡献率及累计方差贡献率;样本协差阵的特征向量表(即主成分的系数表,Eigenvectors)。这些表及分析如

18、下Eigenvalues Eigenvalue Difference Proportion Cumulative PRIN1 4.79742 2.06927 0.552919 0.55292 PRIN2 2.72815 1.57720 0.314429 0.86735 PRIN3 1.15095 . 0.132652 1.00000上表是样本协差阵的特征值表(表头为Eigenvalues),其中PRIN1、PRIN2、PRIN3表示3个主成分,上表第2列给出样本协差阵的特征值,第4列给出方差贡献,第5列给出方差贡献累计百分比。由于前两个特阵值方差贡献累计百分比等于0.867354,它大于0.7

19、,所以只需取两个主成分。 Eigenvectors PRIN1 PRIN2 PRIN3 DEC 0.643587 0.709882 -.286116 JAN 0.213039 0.192899 0.957812 FEB 0.735126 -.677390 -.027085上表是特征向量表(表头为Eigenvectors)上表给出所考察变量样本协差阵的特征向量(0.643587,0.213039,0.735126)、(0.709882,0.192899,-0.677390)和(-0.286116,0.957812,-0.027085)。因此第一、二、三主成分分别是=0.643587Dec+0.2

20、13039Jan+0.735126Feb,=0.709882Dec+0.192899Jan-0.677390Feb,由于第一主成分中Dec,Feb系数是较大正数,Jan系数是较小正数,说明第一主成分主要表示冬季气温偏高的程度,由于1月分的系数变化较小,冬季气温偏高主要由12月,2月温度的偏高形成。第二主成分Dec系数与Feb系数反号较大,反映第二主成分主要表示12月与2月温度距平的反差,即12月温度距平减去2月温度距平所得值的反差。例55 美国各州犯罪率情况如表5-2。试以murder(谋杀),rape(强奸),robbery(抢劫),assult(斗殴),burglary(夜盗),larce

21、ny(偷窃),auto(汽车犯罪)为7元随机向量,做主成分分析。表 5-2 美国各州犯罪率(十万人中犯罪人数)murderraperobberyassultburglarylarcenyautoAlbama14.225.296.8278.31135.51881.9280.7Alaska10.851.696.8284.01331.73369.8753.3Arirona9.534.2138.2312.32346.14467.4439.5Arkansas8.834.2138.2312.32346.14467.4439.5Califonia11.549.4287.0358.02139.43499.86

22、63.5Colorado6.342.0170.7292.91935.23903.2477.1Conecticat4.216.8129.5131.81346.02620.7593.2Delaware6.024.9157.0194.21682.63678.4467.0Florida10.239.6187.9449.11859.93840.5351.4Geogia11.731.1140.5256.51351.12170.2297.9Hawaii7.225.5128.064.11911.53920.4489.4Idaho5.519.439.6172.51050.82599.6237.6Illinois

23、9.921.8211.3209.01085.02828.5528.6Indiana7.426.5123.2153.51086.22498.7377.4Iowa2.310.641.289.8812.52685.1219.9Kansas6.622.0100.7180.51270.42739.3244.3Kentaky10.119.181.1123.3872.21662.1245.4Loisana15.530.9142.9335.51165.52469.9337.7Maine2.413.538.7170.01253.12350.7246.9Maryland8.034.8292.1358.91400.

24、03177.7428.5Masschusetts3.120.8169.1231.61532.22311.31140.1Michigan9.338.9261.9274.61522.73159.0545.5Minnesota2.719.585.985.81134.72559.3343.1Mississippi14.319.665.7189.1915.61239.9144.4Missouri9.628.3189.0233.51318.32424.2378.4Montana5.416.739.2156.8804.92773.2309.3Nebraska3.918.164.7112.7760.02316

25、.1249.1Nevada15.849.1323.1355.02453.14212.6559.2Mew Hampashare3.210.723.276.01041.72343.9293.4New Jersey 5.621.0180.4185.11435.82774.5511.5New Maxico8.839.1109.6343.41418.73008.6259.5New York10.729.4472.6319.11728.02782.0745.8North Carolina10.617.061.3318.31154.12037.8192.1North Dakoda100.99.013.343

26、.8446.11843.0144.7Ohio7.827.3190.5181.11216.02696.8400.4Oklahoma8.629.273.8205.01288.22228.1326.8Oregan4.939.9124.1286.91636.43506.1388.9Pennsyvania5.6 19.0130.3128.0877.51624.1333.2Rhode Island3.610.586.5201.01849.52844.1791.4South Carolina 11.933.0105.9485.31613.62342.4245.1South Dakoda2.013.517.9

27、155.7570.51704.4147.5Tennessee10.129.7145.8203.91259.71776.5314.0Texas13.333.8152.4208.21603.12988.7397.6Utah3.520.368.8147.31171.63004.6334.5Vermont1.415.930.8101.21348.22201.0265.2Virginia9.023.392.1165.7986.22521.2226.7Wasinton4.339.6106.2224.81605.63386.9360.3West Viginia6.013.242.290.9597.41341

28、.7163.3Wiskonsin2.812.952.263.7846.92614.2220.7Wyoming5.421.939.7173.9811.62772.2282.0 解:评估美国各州犯罪率时,用7种犯罪率为7维随机向量,以50个州的统计数据为50次观测。考虑不同犯罪的犯罪率差异很大,用相关阵计算主成分。采用程序data crime; /*建立数据集crime*/input state $ 1-15 murder rape robbery assult burglary larceny auto;/*建立变量state murder rape robbery assult burglar

29、y larceny auto。state $ 1-15表示前15列存州名。murder rape robbery assult burglary larceny auto 表7种罪的犯罪率*/cards; /*以下为数据体*/ Albama 14.2 25.2 96.8 278.3 1135.5 1881.9 280.7 Alaska 10.8 51.6 96.8 284.0 1331.7 3369.8 753.3 Arirona 9.5 34.2 138.2 312.3 2346.1 4467.4 439.5 Arkansas 8.8 34.2 138.2 312.3 2346.1 4467

30、.4 439.5 Califonia 11.5 49.4 287.0 358.0 2139.4 3499.8 663.5 Colorado 6.3 42.0 170.7 292.9 1935.2 3903.2 477.1 Conecticat 4.2 16.8 129.5 131.8 1346.0 2620.7 593.2 Delaware 6.0 24.9 157.0 194.2 1682.6 3678.4 467.0 Florida 10.2 39.6 187.9 449.1 1859.9 3840.5 351.4 Geogia 11.7 31.1 140.5 256.5 1351.1 2

31、170.2 297.9 Hawaii 7.2 25.5 128.0 64.1 1911.5 3920.4 489.4 Idaho 5.5 19.4 39.6 172.5 1050.8 2599.6 237.6 Illinois 9.9 21.8 211.3 209.0 1085.0 2828.5 528.6 Indiana 7.4 26.5 123.2 153.5 1086.2 2498.7 377.4 Iowa 2.3 10.6 41.2 89.8 812.5 2685.1 219.9 Kansas 6.6 22.0 100.7 180.5 1270.4 2739.3 244.3 Kenta

32、ky 10.1 19.1 81.1 123.3 872.2 1662.1 245.4 Loisana 15.5 30.9 142.9 335.5 1165.5 2469.9 337.7Maine 2.4 13.5 38.7 170.0 1253.1 2350.7 246.9 Maryland 8.0 34.8 292.1 358.9 1400.0 3177.7 428.5 Masschusetts 3.1 20.8 169.1 231.6 1532.2 2311.3 1140.1Michigan 9.3 38.9 261.9 274.6 1522.7 3159.0 545.5 Minnesot

33、a 2.7 19.5 85.9 85.8 1134.7 2559.3 343.1 Mississippi 14.3 19.6 65.7 189.1 915.6 1239.9 144.4 Missouri 9.6 28.3 189.0 233.5 1318.3 2424.2 378.4 Montana 5.4 16.7 39.2 156.8 804.9 2773.2 309.3 Nebraska 3.9 18.1 64.7 112.7 760.0 2316.1 249.1 Nevada 15.8 49.1 323.1 355.0 2453.1 4212.6 559.2 Mew Hampashar

34、e 3.2 10.7 23.2 76.0 1041.7 2343.9 293.4 New Jersey 5.6 21.0 180.4 185.1 1435.8 2774.5 511.5 New Maxico 8.8 39.1 109.6 343.4 1418.7 3008.6 259.5 New York 10.7 29.4 472.6 319.1 1728.0 2782.0 745.8 North Carolina 10.6 17.0 61.3 318.3 1154.1 2037.8 192.1 North Dakoda 100.9 9.0 13.3 43.8 446.1 1843.0 14

35、4.7 Ohio 7.8 27.3 190.5 181.1 1216.0 2696.8 400.4 Oklahoma 8.6 29.2 73.8 205.0 1288.2 2228.1 326.8 Oregan 4.9 39.9 124.1 286.9 1636.4 3506.1 388.9 Pennsyvania 5.6 19.0 130.3 128.0 877.5 1624.1 333.2 Rhode Island 3.6 10.5 86.5 201.0 1849.5 2844.1 791.4South Carolina 11.9 33.0 105.9 485.3 1613.6 2342.

36、4 245.1South Dakoda 2.0 13.5 17.9 155.7 570.5 1704.4 147.5 Tennessee 10.1 29.7 145.8 203.9 1259.7 1776.5 314.0 Texas 13.3 33.8 152.4 208.2 1603.1 2988.7 397.6 Utah 3.5 20.3 68.8 147.3 1171.6 3004.6 334.5 Vermont 1.4 15.9 30.8 101.2 1348.2 2201.0 265.2 Virginia 9.0 23.3 92.1 165.7 986.2 2521.2 226.7

37、Wasinton 4.3 39.6 106.2 224.8 1605.6 3386.9 360.3 West Viginia 6.0 13.2 42.2 90.9 597.4 1341.7 163.3 Wiskonsin 2.8 12.9 52.2 63.7 846.9 2614.2 220.7 Wyoming 5.4 21.9 39.7 173.9 811.6 2772.2 282.0;proc princomp out=crimprin; /*调用PRINCOMP过程,用相关阵做主成分分析*/ var murder rape robbery assult burglary larceny

38、auto; /*对这7个变量做分析*/run;执行以上程序,电脑按相关阵做主成分分析;输出主要数表有:样本相关阵的特征值(表头为Eigenvalues of the Correlation Matrix)表,方差贡献、方差贡献率及累计方差贡献率;样本相关阵的特征向量(表头为Eigenvectors)。表及解释如下Eigenvalues of the Correlation Matrix Eigenvalue Difference Proportion Cumulative 1 3.81730007 2.78454963 0.5453 0.5453 2 1.03275044 0.22145080

39、 0.1475 0.6929 3 0.81129963 0.14770303 0.1159 0.8088 4 0.66359660 0.35782066 0.0948 0.9036 5 0.30577594 0.06348335 0.0437 0.9472 6 0.24229259 0.11530785 0.0346 0.9819 7 0.12698474 0.0181 1.0000Eigenvectors Prin1 Prin2 Prin3 Prin4 Prin5 Prin6 Prin7murder -.094836 0.893895 0.335604 0.264209 0.087862 0

40、.037372 -.020129rape 0.433768 0.218170 -.298382 -.102754 -.033667 -.772201 -.259286robbery 0.398823 0.091935 0.367321 -.422729 -.696268 0.173693 0.062497assult 0.39223 0.2585 -.37199 -.431946 0.445511 0.353752 0.361585burglary 0.463531 -.067937 -.044742 0.305199 0.096792 0.445645 -.690946larceny 0.4

41、02967 -.071041 -.14078 0.678773 -.216768 -.005623 0.55226 auto 0.335705 -.261558 0.709373 -.021882 0.501519 -.219929 0.123736由特征值表(表头为 Eigenvalues of the Correlation Matrix),第5列可见,前3个特征值所占比例之和为0.80,只要取3个主成分就够了。由特征向量表(表头为Eigenvectors),从第2列起,每列是1个特征向量。第1个特征向量各个分量值大体相同,近似于=0.38;所以第1主成分表示各州犯罪程度的严重性。第2个特

42、征向量各分量对应murder,rape, assult,分量值为负的,对应burglary,larceny,auto分量是正的,murder,rape, assult暴力程度重, burglary,larceny,auto暴力程度轻,因此第二主成分反映暴力程度的轻重,第二主成分的值越大,暴力成分越轻。第三主成分的特性不明显,不考虑。第一、第二主成分分别为:y1=0.303311murder+0.432675rape+0.391443robbery+0.401331assult+0.4434023burglary+0.361074larceny+0.29296226auto;y2=-0.6634

43、076murder-0.167388rape+0.019456robbery-0.335621assult +0.237752burglary+0.391665 arceny+0.496972 auto许多统计资料简化成样本协差阵,或样本相关阵;这时仍可用SAS的princomp过程计算,只是在data步输入数据时要用“_type_=COV”语句说明。例56 测量雄龟甲的长、宽、厚,并求其自然对数,得到变量;所得24只龟数据的协方差阵如下表,试作主成分分析。表5.3 龟甲数据的协方差阵由于观测资料已被处理为协方差阵,而协方差阵是对称的,只需要输入下三角阵即可,协差阵乘以常数不改变特征向量和累积

44、方差贡献率,所以0.001不用输入。我们采用如下程序 data turtle(type=cov); /*建立数据集turtle*/_type_='cov' /*数据集为协方差阵类型*/input name $ x1-x3; /*建立变量name x1 x2 x3 */cards; /*以下是数据体*/x1 11.072 . .x2 8.019 6.417 .x3 8.160 6.005 6.773; /*空语句,结束数据体*/proc princomp COV; /*用协方差阵计算3个主成分*/var x1-x3; /*对变量x1 x2 x3求主成分*/run;执行后电脑按相关阵做主成分分析;输出主要数表有:协方差阵的特征值(表头为Eigenvalues),特征向量表(表头为Eigenvectors)。解释如下Eigenvalues Eigenvalue Diff

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论