1.2_SAS中判别分析ppt课件_第1页
1.2_SAS中判别分析ppt课件_第2页
1.2_SAS中判别分析ppt课件_第3页
1.2_SAS中判别分析ppt课件_第4页
1.2_SAS中判别分析ppt课件_第5页
已阅读5页,还剩26页未读, 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、用SAS进行判别分析距离判别贝叶斯判别典型判别fisher判别)逐步判别距离判别 Obs x1 x2 x3 x4 group 1 13.85 2.79 7.80 49.60 A 2 22.31 4.67 12.31 47.80 A 3 28.82 4.63 16.18 62.15 A 4 15.29 3.54 7.50 43.20 A 5 28.79 4.90 16.12 58.10 A 6 2.18 1.06 1.22 20.60 B 7 3.85 0.80 4.06 47.10 B 8 11.40 0.00 3.50 0.00 B 9 3.66 2.42 2.14 15.10 B 10 1

2、2.10 0.00 5.68 0.00 B 11 8.85 3.38 5.17 26.10 12 28.60 2.40 1.20 127.00 13 20.70 6.70 7.60 30.20 14 7.90 2.40 4.30 33.20 15 3.19 3.20 1.43 9.90 16 12.40 5.10 4.43 24.60 17 16.80 3.40 2.31 31.30 18 15.00 2.70 5.02 64.00书p182,表5.1,盐泉的特征数值data ds511; input x1-x4 group $; cards;13.85 2.79 7.80 49.60 A 2

3、8.79 4.90 16.12 58.10 A 2.18 1.06 1.22 20.60 B 12.10 0.00 5.68 0.00 B;data d511test; input x1-x4 group $; cards; 8.85 3.38 5.17 26.10 .28.60 2.40 1.20 127.0 . 15.00 2.70 5.02 64.00 .;proc discrim data=ds511 testdata=d511test list testlist; class group; var x1-x4;run;两个数据集:ds511、d511test,分别是训练数据和待判别的

4、数据。在discrim语句中,要用testdata=d511test来指明,d511test是待判别的数据集。输入字符串数据时,可以用英文句点.来表示空字符串。LIST,印出各觀察值被分類的結果TESTLIST,印出被測試資料內所有觀察值data d511; input x1-x4 group $; cards;13.85 2.79 7.80 49.60 A 28.79 4.90 16.12 58.10 A 2.18 1.06 1.22 20.60 B 12.10 0.00 5.68 0.00 B 8.85 3.38 5.17 26.10 .28.60 2.40 1.20 127.0 . 15

5、.00 2.70 5.02 64.00 .;options ps=60 ls=75;proc print data=d511;run;proc discrim data=d511 simple wcov pcov wsscp psscp distance list; class group; var x1-x4;run;Options ps=60 ls=75表示输出屏幕定义为一页60行,每行75字符proc print以报表方式输出数据集wsscp,打印各组的离差交乘积和矩阵这个程序与前一个程序略有不同,它没有采用两个数据集,而是把训练数据和待判别数据全部写到一个数据集:d511。distan

6、ce,打印各组之间的马氏距离,和F统计量。PROC DISCRIM OPTIONS 選擇項有: (1)DATA=SASdataset,指定作判別分析之資料組 (2)OUT=SASdataset,指定存放判別分析後計量之資料組 *(3)TESTDATA=SASdataset,指定一個用來測試判別函數的資料組 (4)WCOV,印出各類別裏之共變數矩陣 (5)WCORR,印出各類別之相關矩陣 (6)SIMPLE,印出原始變數之平均數,標準差等 (7)PCOV,印出各類別裏共變數矩陣的平均數 (8)PCORR,印出淨相關係數矩陣的平均數 (9)LISTERR,印出被分到錯誤類別的觀察值 (10)TES

7、TLIST,印出被測試資料內所有觀察值 (11)LIST,印出各觀察值被分類的結果 (12)TESTLISTERR,印出在測試資料組內被分到錯誤類別的觀察值 *(13)NOSUMMARY,分類結果暫時不印出*(14)POOL=YES或=TEST,系統內定值為=YES,其分析所用的判別函數來自各類別之共變數矩陣.若選=TEST,則用Ratio Test考驗各類別裏的共變數矩陣相同程度是否達顯著水準,若達顯著水準,其功用如POOL=NO,若否,則如POOL=YES. *(15)THRESHOLD=P,指定一個最小的事後機率(posterior probability)贝叶斯判别 Obs group

8、 x1 x2 x3 x4 1 1 228 134 20 11 2 1 245 134 10 40 3 1 200 167 12 27 4 1 170 150 7 8 5 1 100 167 20 14 6 2 225 125 7 14 7 2 130 100 6 12 8 2 150 117 7 6 9 2 120 133 10 26 10 2 160 100 5 10 11 3 185 115 5 19 12 3 170 125 6 4 13 3 165 142 5 3 14 3 135 108 2 12 15 3 100 117 7 2书p192,表5.2,胃癌检验的生化指标Group=1

9、,胃癌Group=2,萎缩性胃炎Group=3,非胃炎data d522; input group x1-x4 ; cards;1 228 134 20 11 1 245 134 10 401 200 167 12 27 1 170 150 7 81 100 167 20 14 2 225 125 7 142 130 100 6 12 2 150 117 7 62 120 133 10 26 2 160 100 5 103 185 115 5 19 3 170 125 6 43 165 142 5 3 3 135 108 2 123 100 117 7 2;proc print data=d5

10、22;run;proc discrim data=d522 pool=no distance list; class group; priors 1=0.33333 2=0.33333 3=0.33333; var x1-x4;run;Priors语句,指出每组患者的先验概率。典型判别( fisher法data d522; proc candisc data=d522 out=can532 ncan=2 distance simple; class group; var x1-x4;run;proc plot data=can532; plot can2*can1 = group;run;pr

11、oc print data=can532;run;proc discrim data=can532 distance list; class group; var can1 can2;run;proc discrim data=can532 pool=no distance list; class group; var can1 can2;run;P198,例5.3.2,还是p192表5.2的数据,但用典型判别法的做法ncan=2指出原始数据投影到2维空间中,使类间距离最大化,类内距离最小化后,所得的2维数据。 Obs group x1 x2 x3 x4 Can1 Can2 1 1 228 1

12、34 20 11 2.75459 1.12712 2 1 245 134 10 40 2.04732 1.26078 3 1 200 167 12 27 2.87670 -0.85375 4 1 170 150 7 8 0.42984 -1.78803 5 1 100 167 20 14 2.88596 0.00755 6 2 225 125 7 14 0.16132 -0.26364 7 2 130 100 6 12 -2.03517 1.18626 8 2 150 117 7 6 -1.15808 -0.03218 9 2 120 133 10 26 0.32348 0.93155 10

13、2 160 100 5 10 -1.97122 0.78573 11 3 185 115 5 19 -0.84243 0.42801 12 3 170 125 6 4 -0.87319 -0.83084 13 3 165 142 5 3 -0.44736 -1.96201 14 3 135 108 2 12 -2.36910 0.08988 15 3 100 117 7 2 -1.78267 -0.08642这是pool=yes的判别结果这是pool=no的判别结果逐步判别data d522; input group x1-x4 ; cards;1 228 134 20 11 1 245 13

14、4 10 401 200 167 12 27 1 170 150 7 81 100 167 20 14 2 225 125 7 142 130 100 6 12 2 150 117 7 62 120 133 10 26 2 160 100 5 103 185 115 5 19 3 170 125 6 43 165 142 5 3 3 135 108 2 123 100 117 7 2;proc stepdisc data=d522 METHOD=STEPWISE sle=0.15 sls=0.15; class group; var x1-x4;run;P210,例5.5.1,还是p192表5

15、.2的数据,但采用逐步判别法的做法Method=stepwise|sw,变量增减的逐步判别Method=backward|bw,变量减少法Method=forword|fw,变量增加法Sle或slentry=p,引入变量的显著性水平,默认0.15Sls或slstay=p,剔除变量的显著性水平,默认0.15proc discrim data=d522 list; class group; var x2 x3;run;用stepdisc,只能得出那些被选出的变量。要做判别分析,还需要使用discrim过程,明确地做一次判别分析。练习一、书p213,5-9题。用距离判别法判断最后一行待判数据含不含矿

16、。实验报告只写结果是含矿,还是不含矿。typecuagbi12.580.90.9512.91.23113.551.15112.351.150.7913.541.850.7912.72.231.312.71.70.4802.251.981.0602.161.81.0602.331.741.101.961.481.0401.941.41031.3102.781.71.482.952.151.54Type=1,含矿Type=0,不含矿最后一行,待判数据练习二、书p213,5-10题。用逐步判别法,取sle=sls=0.18,指出选择了哪几个变量,并判断右边三个待判数据。x1x2x3x4type6-1

17、1.519901-11-18.525-36390.2-171732-4-15135410-14203520.5-11.519373-10-1921-4230-235-35120-228-203-100-21.47-151-100-21.515-40213-17.21822-5-18.51518110-1814501-8-14165610.6-1326213-40-2022-503-8-14165692.2-17183-14-18.525-36练习三、书p214,5-11题。判断最下边两个待判数据属于哪一类。实验报告只写结果是哪一类。x1x2x3type0.0450.0430.26520.0660.0390.26420.0940.0610.19420.0030.0030.10230.0480.0150.10630.210.0660.26310.0860.0720.27420.1960.0720.21110.1870.0820.30110.0530.060.20920.020.0080.11230.0350.0150.1730.2050.0680.28410.0880.0580.21520.1010.0520.1810.0450.0050.122练习四、三种

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

最新文档

评论

0/150

提交评论