



全文预览已结束
下载本文档
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
虚拟变量(Dummy Variable),又称虚设变量、名义变量或哑变量,是量化了的质变量,通常取值为0或1。引入哑变量可使线形回归模型变得更复杂,但对问题描述更简明。 名义变量引入回归分析,必须进行数量化。如,职业有工人、农民、教师,分别赋值0,1,2。但是0,1,2代表的实际意义又不是由小到大的关系。所以这在回归分析中直接使用是错误的。如考虑季节因素时,用1,2,3,4编码也是不合理的,通常也进行哑变量化。 对于有序变量,如轻、中、重,则要酌情考虑。如果样本量足够大的话,也进行哑变量化,这样可以得到不同级别的差异。但是如果样本量不够大是,哑变量化造成变量数目上升,使回归结果变得不可靠,只能适得其反。哑变量设置的原则 在模型中引入多个哑变量时,哑变量的个数应按下列原则确定: 如果有m种互斥的属性类型,在模型中引入(m-1)个哑变量。 例如,文化程度分小学、初中、高中、大学、研究生5类,引用4个哑变量回归分析 在spss中,logistics回归中,有专门的选项来处理需要哑变量化的变量,只需单击“Categorical.”进行设置即可。但是对于多元线性回归就没有那么幸运了。 用computer或recode设置一组哑变量。由于哑变量是一个整体变量,所以进行变量筛选时必须共同进退。因此,将所有哑变量同一般变量一块直接进行筛选是不对的,会出现一部分变量进入一部分变量未进入的情形。解决的方法是:将同一因素下的哑变量进行归组,在纳入方法中选择了“ENTER”来确保这些哑变量同进同出,而其它连续型变量和二分类变量则归为另一组,纳入方法为STEPWISE。然后在没有纳入这组哑变量的情况下再做一次STEPWISE,再来比较是不是应该纳入这组哑变量。在sas中,哑变量的设置需要另外写程序,但是在回归程序中,则比较简单。eg.因变量y,自变量x1,x2,哑变量组x31 x32 x33,proc reg; model y=x1 x2 x31 x32 x33 /selection=stepwise;run;即,把哑变量组用括起来就可以了。SPSS多元线性回归哑变量设置 在spss中,logistics回归中,有专门的选项来处理需要哑变量化的变量,只需单击“Categorical.”进行设置即可。但是对于多元线性回归就没有那么幸运了。 用compute或recode设置一组哑变量。比如学历有三个等级:高中及以下,本科,研究生及以上。设置两个哑变量:学历1,学历2。下面以compute为例说明如何定义哑变量。 利用compute对学历1,学历2进行计算。设置成学历为高中及以下时学历1=0,学历为高中及以下时学历2=0;学历为本科时学历1=1,为本科时学历2=0;为研究生及以上时学历1=0,为研究生及以上时学历2=1。举例如下:在SPSS中将多分类变量设置为哑变量比较麻烦,其中的一种方法就是将该多分类变量转换成N-1列的哑变量,举例来说,原多分类变量有四个取值(A/B/C/D),这时需要设置三列哑变量,比如D2,D3,D4用如果变量值是B,则D2=1,否则取0,如果是C,则用D3=1,否则取0,如果是D,则D4=1,否则取0D2 D3 D41 0 0B0 1 0C1 0 0B0 0 1D0 0 0A注意,4分类只能设置3个哑变量!定义好所有的哑变量之后,接下来就可以进行多元线性回归的计算了。由于哑变量是一个整体变量,所以进行变量筛选时必须共同进退。因此,将所有哑变量同一般变量一下直接进行筛选是不对的,会出现一部分变量进入一部分变量未进入的情形。解决的方法是:将同一因素下的哑变量进行归组(block),在纳入方法中选择了“ENTER”来确保这些哑变量同进同出,而其它因素的哑变量另一组(block),除
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2025年新能源汽车换电模式在共享出行领域的应用与电池资产管理策略报告
- 2025居间合同格式
- 2025年农业生物技术在种子品种培育中的基因资源利用与保护研究报告
- 2025年中国个人漂浮装置行业市场全景分析及前景机遇研判报告
- 泡桐树的特点
- 肺炎与哮喘的区别
- 《离婚协议书范本:婚姻关系解除及子女抚养权明确》
- 婚姻解除财产分割专项离婚协议书范本
- 离婚财产分割与子女抚养安排协议书示范文本
- 租赁住宅人身安全免责及安全保障条款合同
- 同种异体骨软骨移植与软骨修复
- 故障分析实验报告
- 行为生活方式与健康智慧树知到期末考试答案章节答案2024年杭州师范大学
- JTS-165-6-2008滚装码头设计规范-PDF解密
- 铸造企业安全生产标准化管理体系方案资料汇编(2022-2023新标准实施模板)
- 设备维修与保养(课件)
- 浅谈国内外深基坑支护技术的现状及进展
- 网络舆情应对及处置
- 工业数据采集技术及应用 -配置能源采集仪表参数
- 《应急救援知识》课件
- 【一例重症肺炎的个案护理案例报告6000字(论文)】
评论
0/150
提交评论