版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、第三章 SPSS数据文件的基本加工和处理,SPSS数据文件的基本加工和处理,数据文件的整理 个案排序、个案选取、文件合并、文件转置 数据加工 变量转换、产生计数变量 数据分组 自动分组、手工分组 数据文件的其他处理功能 指定加权变量、SPSS变量集的定义和使用,目的: 将所有个案按照用户指定的某一个或多个变量的变量值的升序或降序重新排列。 菜单选项: data - sort cases 注意: (1)Ascending:升序、Descending:降序。 (2)多重排序,选择变量名的次序很关键(前面的变量优先排序)。,个案排序,个案选取,(一)个案选取的方式 (1)选择符合一定条件的个案(If
2、 condition is satisfied) (2)随机选取个案(Random sample of cases) 近似选取、精确选取 (3)选取某一区域内的个案(Based on time or case range) (4)使用过滤变量(use filter variable) 过滤变量非0且非缺失的个案被选中,个案选取,(二)个案选取的步骤 (1)菜单选项: data - select cases (2)对未选中个案的处理方式: filtered: 左侧标记/ delete: 删除 (3)根据不同方式选取个案 注意:以后的操作和分析都在该个案选取的基础上进行.,数据文件的合并,目的:
3、将两个SPSS数据文件合并到一个数据文件中。 文件合并的方式: 纵向合并 横向合并。,数据文件的合并,(一)纵向数据合并 (1)含义: 将磁盘上的或打开的一个SPSS数据文件追加到当前data editor窗口中的数据文件中。 (2)前提: 两个SPSS数据文件应有可以合并的内容,且最好有相同的变量名和变量类型。 (3)菜单选项: data - merge file - add cases,数据文件的合并,(二)横向数据合并 (1)含义: 将磁盘上的或打开的一个SPSS数据文件中的若干个变量增加到当前data editor窗口的数据文件中。 (2)前提(要求较高) a.两个数据文件必须有一个共
4、同的变量名为关键字段-合并的依据; b. .两个数据文件应事先按关键字段升序排序。,数据文件的合并,(二)横向数据合并 (3)菜单选项: data - merge file - add variable (4)选项说明: math cases on key variables in sorted files:以关键字作为合并标志。 Both files provide cases:合并后的文件的数据由两个文件共同提供。 Non-active dataset is keyed table:以data editor的数据为基础。(个案数不同时,丢失Non-active文件的个案) Active d
5、ataset file is keyed table:以磁盘文件的数据为基础。(个案数不同时,丢失Active文件的个案),当两个文件中个案数不同时,数据文件的转置,目的: 将数据文件行列互换,即:将个案转为变量,变量转为个案.,转置前,转置后,数据文件的转置,菜单选项: data-transpose 说明: 系统自动产生一新变量case_lbl,存放原文件的变量名 可以指定关键字变量, 该变量的变量值为新文件的变量名 如有变量未被选中,转置时则被自动丢弃(有提示),数据文件格式的转换,分析要求改变数据的排列格式:,菜单选项: data-Restructure 选项:将宽型数据重排为长型格式
6、将长型数据重排为宽型格式 数据转置,等同于Transpose,ID变量:被重复观测个体的标示变量 Index变量:用于区分观测次数的变量 系统自动判断同一ID变量取值相同的携带变量,转换取值不同的变量,长型格式,宽型格式,ID变量,Index变量,数据加工变量转换,例:话费=移动话费+长途话费 客户价值 目的:产生新变量或对原变量进行必要的转换。 (1)含义: 根据用户给出的SPSS算术表达式,对所有或部分样本数据进行加工。 (2)SPSS算术表达式(Numeric Expression) 由算术运算符(+ 、-、 *、 /、 *)、SPSS函数以及SPSS变量名组成的式子。,变量转换,算术函
7、数 统计函数 分布函数 逻辑函数 字符串函数 日期时间函数 缺失值函数 其他函数,Abs() sqrt() exp() lg10() rnd() trunc() mod() mean() sd() sum() cfvar() max() min() normal() uniform() rv.() cdf.() idf.() range() any() index() length() lower() lpad() ltrim() substr() date.dmy(31,12,1999) time.days(1.5) missing() sysmis() lag(),(3) SPSS函数,变
8、量转换,(4)SPSS条件表达式: 简单条件表达式:由SPSS关系运算符、SPSS函数以及SPSS变量名组成的式子。 关系运算符: (大于)、 =(大于等于)、 32、sr=700,变量转换,(4)SPSS条件表达式 复合条件表达式:由SPSS逻辑运算符、简单条件表达式组成的式子。 逻辑运算符: &(AND):并且 |(OR):或者 (NOT):非 如:(nl32) and (sr700) not xb=1,变量转换,(5)菜单选项: transform-compute variable if 按钮 举例 计算女生的数学成绩(数学类课程的平均成绩),产生计数变量,(1)含义: 对所有或部分个案
9、,标示(用1) 变量中有哪些个案的值落在指定的区域内,并将结果存入新变量中。 (2)菜单选项: transform - count Values within Cases - define value,产生计数变量,(3)指定区域的定义 Value:指定一个值 system-missing:系统缺失值 system-or user missing:系统或用户缺失值 range through:指定一个闭区域,给出最大和最小值 range: lowest through n:个案最小值到某个给定值 range: n through highest:某个给定值到个案最大值,数据文件的分类汇总,例:
10、分别计算不同品牌客户的价值 (1)含义: 按指定的分类变量的变量值对个案分组; 计算每组个案的汇总变量的基本统计量; 将计算结果生成到一新文件中,即:在新文件中对应分类变量的每一个分类值产生一个个案。,原始数据,按性别变量汇总数据,数据文件的分类汇总,(2)菜单选项: data - Aggregate Break Variable(s) 分类变量 Aggregate Variable(s) 汇总变量 (3)说明: 多重分组时,变量名的选择顺序。 生成的新文件名默认为:aggr.sav。可修改。 生成的新变量名默认为原变量名后加_1。可修改。 可以在新文件中存贮分组个案数.,举例,统计男生和女生
11、的各科平均成绩 统计分别性别、文化程度的平均年龄 对于通话详单,统计每个客户通话总时长和总话费,数据分组,目的:了解数据的总体分布状况 思路: 指定按哪个变量分组,即:指定分组变量 定义分组变量的分组区间(不重、不漏) 指定一个存放分组结果的标志变量 分组方法: 自动分组 手工分组,数据分组(标示个案所属组别,但无频数),(一)自动分组 单变量分组 (1)含义: 分组变量值相同的个案分在同一组,同组中的标志变量相同。标志变量依照分组变量值的大小次序给定。(单变量分组,通常只适合于离散变量且变量值较少的情况) (2)菜单选项: transform - Automatic Recode,数据分组,
12、(二)手工分组(组距分组) (1)含义: 人工定义分组区域,对所有个案或符合一定条件的个案进行等距或非等距分组。 (2)方法: 分组结果存入原变量 分组结果存入新变量,数据分组,(3)分组结果存入原变量: 定义分组区域: 定义某一区间的原变量值分组后所对应的新值(往往为组别)是什么.未定义的原变量值为缺失值。 菜单选项: transform - Recode into same variables 说明: 可以指定对符合一定条件的个案进行分组。 单值区间可以实现数据转换(问卷分析中的反向题重新计分),问卷分析中的反向题重新计分举例,性格打分(内向、一般、外向) 1、与生人交往会“自来熟” (1
13、)从不 (2)偶尔 (3)有时 (4)经常 2、与不熟悉的异性交往,会脸红 (1)从不 (2)偶尔 (3)有时 (4)经常 3、 在公众场合下你会大声发表自己的意见 (1)从不 (2)偶尔 (3)有时 (4)经常 极为内向:3分 较为内向:6分 较为外向:9分 极为外向:12分,数据分组,(4)分组结果存入新变量: 定义分组区域:定义某一区间的原变量值分组后所对应的新值是什么.未定义的原变量值在新变量中为系统缺失值。 菜单选项: transform - Recode into Different Variables 定义原变量分组后产生的相应新变量(CHANGE钮) 可以指定对符合一定条件的个
14、案进行分组。,举例,将大客户按月收入高低分为不同等级的客户 将两个班级的学生按高等数学成绩高低分级,SPSS变量集的定义和使用,(1)什么是SPSS变量集 将多个变量定义为一个集合,形成一个SPSS变量集。 (2)SPSS变量集的种类 系统变量集:SPSS变量管理的依据 allvariabls: 包括data editor中的所有变量。 Newvariales:尚未存盘的新定义的所有变量。 用户变量集:简化变量选择的操作过程,SPSS变量集的定义和使用,(3)思路 先将若干个变量定义为一个变量集合 指定使用此变量集 (4)定义变量集 菜单: utilities-define Variable sets 选择进入变量集中的变量名 输入自定义的变量集名称,SPSS变量集的定义和使用,(5)使用变量集 菜单: utilities - use Variable sets 将要使用的变量集选入set in use框中。 说明: 在set in use中应至少有一个变量集。 系统默认使用的是系统变量集,SPSS输出
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 农业生产练习题及精准答案解析
- 2025-2026学年昭通市彝良县四下数学期中学业水平测试模拟试题(含答案解析)
- 文化基础语文测试题目与答案
- 羽毛球运动安全试题及参考答案
- 2025-2026学年广东省深圳市福田区耀华实验学校数学四下期末质量检测试题(含答案)
- 2025-2026学年山东省巨野县四年级数学下学期期中联考模拟试题含答案解析
- 河南生物联赛考试题目及答案解析
- 植物景观测试题与答案解析
- 2026年咖啡饮料冷萃工艺创新与冷链物流管理
- 肿瘤预防控制问答试题及答案
- 2026-2027学年度第一学期工作计划:稳课堂、研教学、强队伍、守底线
- 5、中建商务管理手册(2024年)
- 北京通州农商产业发展集团有限公司招聘17人笔试备考题库及答案详解
- 剪刀式升降车安全技术交底
- 中国融通资源开发集团有限公司物资接收、仓储人员专项招聘87人笔试模拟试题及答案详解
- 硫化物固态电解质生产线项目风险评估报告
- 肘关节关节病护理查房
- 2026年医师定期考核中医试题(完整版)附答案
- 精神科物理治疗工作制度
- 湖北2025年湖北省就业援藏面向山南籍高校毕业生专项招聘62名事业单位工作人员笔试历年参考题库附带答案详解(5卷)
- 辽宁省大连市名校2026届中考数学仿真试卷含解析
评论
0/150
提交评论