SPSS数据分析与应用-B卷-模拟试卷及答案_第1页
SPSS数据分析与应用-B卷-模拟试卷及答案_第2页
SPSS数据分析与应用-B卷-模拟试卷及答案_第3页
SPSS数据分析与应用-B卷-模拟试卷及答案_第4页
SPSS数据分析与应用-B卷-模拟试卷及答案_第5页
已阅读5页,还剩3页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

试卷第页)2025-2026学年第二学期《SPSS数据分析与应用》模拟试题B卷专业:经济管理类各专业考试形式:闭卷题号一二三四总分得分注意事项:请在规定位置填写个人信息;答案写在答题区域;计算题须写出过程。学号_____________班级___________姓名________考场号____学号_____________班级___________姓名________考场号____座位号____------------------------------密○------------------------封○---------------------线○------------------------------在每小题列出的四个选项中只有一个符合题目要求,错选、多选或未选均不得分。1.SPSS中用于区分“名义、顺序、标度”的变量属性是()。A.宽度B.测量尺度C.角色D.列2.将两个年份、变量结构一致的客户记录纵向合并,应使用()。A.添加个案B.添加变量C.变量计算D.可视分箱3.比较不同地区销售额分布并识别异常值,较合适的图形是()。A.饼图B.箱线图C.人口金字塔图D.简单条形图4.Pearson相关系数r=-0.80表示两个变量()。A.高度正相关B.较强负相关C.不存在关系D.必然具有因果关系5.因子分析中,某变量共同度为0.76表示()。A.该变量76%的方差可被所提取因子解释B.该变量与因子无关C.必须提取76个因子D.样本中76%为缺失6.因子数确定通常可综合参考()。A.特征值、累计方差贡献率和碎石图B.仅样本均值C.仅变量名D.分类表7.系统聚类中用于展示样本逐步合并过程的典型图形是()。A.ROC曲线B.树状图C.散点图矩阵D.残差图8.线性回归ANOVA表中的F检验主要用于判断()。A.模型整体是否显著B.每个自变量是否显著C.残差是否为0D.因变量是否二分类9.线性回归中标准化系数Beta的一个常见用途是()。A.比较不同量纲自变量的相对作用大小B.计算样本量C.替代所有显著性检验D.确定聚类数10.逻辑回归ROC分析中,AUC=0.50通常表示模型()。A.区分能力接近随机B.预测完全正确C.存在严重共线性D.所有系数显著二、判断题(本大题共10小题,每小题1分,共10分)判断下列说法是否正确,正确写“T”,错误写“F”。11.值标签可以提高分类变量取值的可读性。()12.选择个案后,不需要说明实际进入分析的样本范围。()13.中位数比均值更容易受到极端值影响。()14.双定性变量关系可通过交叉表及相应百分比进行描述。()15.因子载荷绝对值越大,通常说明原变量与该因子的关系越密切。()16.因子旋转会改变所提取因子的累计解释总方差。()17.聚类分析的结果可能受变量选择和距离度量方式影响。()18.K-means聚类中,不同初始中心可能产生不同结果。()19.回归模型可以在不检查样本范围的情况下无限外推。()20.逻辑回归的因变量可编码为0和1。()三、简答题(本大题共6小题,每小题5分,共30分)21.简述SPSS变量定义中五项常用属性及其作用。(5分)答:22.简述数据排序、去重、重新编码、分组和选取的作用。(5分)答:23.说明均值、中位数和标准差各自反映什么信息。(5分)答:24.解释KMO检验、Bartlett球形检验和因子载荷的作用。(5分)答:25.简述聚类分析的一般流程。(5分)答:26.简述逻辑回归模型常用的评价指标。(5分)答:四、综合题(本大题共4小题,每小题10分,共40分)27.某企业员工数据包含年龄、学历、入职测试分数、月薪等变量。现需生成“年龄组”“是否高分”“月均可支配薪资等级”,并仅分析工作年限不少于3年的员工。(10分)(1)说明为什么建议将重新编码结果保存为新变量。(2分)(2)设计年龄组或测试分数组别时应遵循什么原则。(2分)(3)说明“是否高分”的条件计算思路。(2分)(4)说明如何限定分析样本并核验选取结果。(2分)(5)指出处理日志至少应记录的两项内容。(2分)28.某通信公司用月消费、通话时长、流量使用量、在网时长对客户聚类。由于变量量纲差异较大,分别尝试K=3和K=4。K=3时各类样本量为420、390、410,画像清晰;K=4时有一类仅12人且画像不稳定。(10分)(1)说明聚类前为何需要标准化。(2分)(2)比较K=3和K=4,你更倾向选择哪个方案并说明理由。(3分)(3)说明最终聚类中心表的作用。(2分)(4)给出一项检验聚类结果稳定性的做法。(1分)(5)指出客户分群应用中应注意的伦理问题。(2分)29.空气质量指数AQI的多元线性回归结果为:调整R²=0.72;ANOVA表F检验p<0.001;PM2.5系数B=0.65,p<0.001,VIF=2.1;温度系数B=-0.18,p=0.032,VIF=1.4。(10分)(1)解释调整R²=0.72。(2分)(2)解释F检验结果。(2分)(3)解释PM2.5系数B=0.65。(2分)(4)根据VIF判断共线性情况。(2分)(5)说明为什么不能直接宣称PM2.5对AQI具有已证实的因果效应。(2分)30.客户流失逻辑回归模型中,年龄B=0.073,p<0.001,Exp(B)=1.076;是否为活跃会员B=-1.079,p<0.001,Exp(B)=0.340。模型总体准确率为79%,AUC=0.756。(10分)(1)解释年龄的Exp(B)=1.076。(3分)(2)解释活跃会员的Exp(B)=0.340。(3分)(3)解释AUC=0.756。(2分)(4)指出仅凭总体准确率评价模型的不足,并补充一个指标。(2分)《SPSS数据分析与应用》模拟试题B参考答案与评分标准专业:经济管理类各专业考试形式:闭卷一、单项选择题(本大题共10小题,每小题2分,共20分)1.B2.A3.B4.B5.A6.A7.B8.A9.A10.A二、判断题(本大题共10小题,每小题1分,共10分)11.T12.F13.F14.T15.T16.F17.T18.T19.F20.T三、简答题(本大题共6小题,每小题5分,共30分)21.参考答案:(1)变量名。(1分)(2)类型。(1分)(3)标签/值标签。(1分)(4)缺失值。(1分)(5)测量尺度。(1分)说明:表述合理、意思相近可酌情给分。22.参考答案:(1)排序揭示顺序/极值。(1分)(2)去重处理重复记录。(1分)(3)重新编码调整类别。(1分)(4)分组离散化连续变量。(1分)(5)选取限定分析样本。(1分)说明:表述合理、意思相近可酌情给分。23.参考答案:(1)均值反映平均水平。(1分)(2)中位数反映居中位置。(1分)(3)中位数对极端值稳健。(1分)(4)标准差反映离散程度。(1分)(5)需结合分布与样本解释。(1分)说明:表述合理、意思相近可酌情给分。24.参考答案:(1)KMO评价共同因素基础。(1分)(2)KMO越接近1越适合。(1分)(3)Bartlett检验相关矩阵是否单位阵。(1分)(4)p<0.05通常支持因子分析。(1分)(5)载荷反映变量与因子关系。(1分)说明:表述合理、意思相近可酌情给分。25.参考答案:(1)明确目的和对象。(1分)(2)选择变量并处理缺失。(1分)(3)必要时标准化。(1分)(4)选择算法/距离/K值。(1分)(5)解释验证并形成画像。(1分)说明:表述合理、意思相近可酌情给分。26.参考答案:(1)Omnibus整体检验。(1分)(2)-2LL/伪R²。(1分)(3)分类准确率。(1分)(4)敏感度与特异度。(1分)(5)ROC/AUC及阈值。(1分)说明:表述合理、意思相近可酌情给分。四、综合题(本大题共4小题,每小题10分,共40分)27.参考答案与评分标准:(1)保存为新变量可保留原始值,便于核对、追溯和修改分组规则。(2分)(2)按业务含义确定组数和边界,做到不重不漏,并妥善处理缺失值/极端值。(2分)(3)用计算变量结合If条件,如测试分数达到规定阈值赋值1,否则赋值0,并设置值标签。(2分)(4)用“选择个案”设置工作年限>=3;通过筛选状态、频数和选取前后样本数核验。(2分)(5)记录原变量、新变量、表达式/边界、处理日期、处理前后样本数或异常说明中的任两项。(2分)说明:计算过程正确但存在非关键性算术错误,可酌情给步骤分。28.参考答案与评分标准:(1)不同量纲会使大数值变量主导距离;标准化使各指标在距离计算中更可比。(2分)(2)倾向K=3:三类规模较均衡、画像清晰;K=4产生仅12人的小类且不稳定,可能是异常点或过度细分。仍应结合业务目标和稳定性验证。(3分)(3)最终聚类中心展示各类在各变量上的典型水平,可用于比较类别特征、命名和形成画像。(2分)(4)更换初始中心/随机种子、抽样重跑,或用不同方法交叉验证类别一致性。(1分)(5)避免污名化标签、歧视定价和过度营销,保护隐私并允许人工复核。(2分)说明:计算过程正确但存在非关键性算术错误,可酌情给步骤分。29.参考答案与评分标准:(1)控制模型自变量个数后,模型解释AQI样本变异的约72%,拟合度较高但仍有28%未解释。(2分)(2)p<0.001说明模型整体显著,即至少一个自变量与AQI存在线性统计关联。(2分)(3)其他变量不变时,PM2.5每增加1单位,AQI平均增加0.65单位;该系数显著。(2分)(4)VIF为2.1和1.4,均不高,未见严重多重共线性。(2分)(5)观测数据可能存在遗漏变量、反向关系和测量偏差;回归控制不等于随机实验,故只能谨慎表述关联。(2分)说明:计算过程正确但存在非关键性算术错误,可

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

最新文档

评论

0/150

提交评论