下载本文档
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、数据的标准化处理及实际应用数据标准化处理是数据挖掘一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决数据指标之间的可比性。原始数据经过数据标准化处理后,各指标即处于同一数量级,适合进行综合对比评价。极差法极差法是对原始数据的线性变换,首先计算指标值得最小值、最大值,计算极差,通过极差法将指标值映射到0-1之间。公式为:新数据=(原数据-极小值)/(极大值-极小值)Z-score标准化法SPSS默认的数据标准化方法即是Z得分法,这种方法基于原始数据的均值(mean)和标准差(standarddevi
2、ation)进行数据的标准化。经过处理的数据符合标准正态分布,即均值为0,标准差为1。公式为:其中为所有样本数据的均值,为所有样本数据的标准差。数据标准化的另外一个实用之处在实际应用中,数据标准化不只是用于指标的可比性处理,还有一些非常实用的用处,利用标准化方法将指标归到最适于我们观测的范围,更加直观。且看案例:有一组数据,是学生参加某次社会公益活动的数据,其中有一指标为:在校综合评价指数,反映学生在校综合表现水平。可以看出这个指标的范围为0-140,但这个范围不太符合我们在学校里的习惯,在学校里经常用0-100的百分制,60分以上基本认可为及格,现在这个范围不能直观的反映学生在校表现水平。此时,极差法是一个非常好的选择,我们可以将0-140数值,映射到0-100,便于直观对比学生的表现。公式为:(原数据-极小值)/(极大值-极小值)*100我们再来看看结果:此时,0-100的范围非
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 城市垃圾分类与清运合同范本
- 生态翻译学视角下《美丽甘肃》(节选)汉英翻译实践报告
- 具有高储荷容量水系自支撑电极结构设计精准构筑及储荷性能研究
- 泾县郭峰方音声学实验研究
- 商品分析营销方案
- 动态体育营销方案
- 集宁政府活动策划方案
- 逾期协商法律咨询方案模板
- 策划答题活动方案步骤
- 口腔营销成功方案
- 2025年发酵豆粕行业研究报告及未来行业发展趋势预测
- 植物的后代与亲代 教案设计 核心素养目标鄂教版科学五年级上册
- 2025杭州市二手房买卖合同模板
- 从知识翻译学角度研究二十四节气英译策略与实践
- 电线电缆行业知识培训课件
- GB/T 4026-2025人机界面标志标识的基本和安全规则设备端子、导体终端和导体的标识
- 义务教育评估学校自查工作方案
- 水泵型号及选型说明手册
- 2025-2030中国商业遥感卫星数据定价机制与政府采买趋势分析报告
- 千万工程培训课件
- 2025年统编版(2024)小学道德与法治二年级上册《教师节快乐》教学设计
评论
0/150
提交评论