心理基础及测量_第1页
心理基础及测量_第2页
心理基础及测量_第3页
心理基础及测量_第4页
心理基础及测量_第5页
已阅读5页,还剩15页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

PAGE1心理测量课程教学大纲一、课程简介课程类别:专业基础课(必修)授课对象:心理学、应用心理学及相关专业本科生学时与学分:32学时,2学分(可按培养方案调整)参考教材:李英武,董妍.(2026).心理测量.北京:中国人民大学出版社参考教材:1.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.二、教学目的与教学要求《心理测量》是心理学与应用心理学专业的重要基础课程。课程围绕心理属性如何被界定、观察、量化和解释,系统介绍心理测验的历史、编制与使用伦理,经典测验理论、项目反应理论、概化理论和认知诊断理论,以及信度、效度、项目分析、测量等价、认知能力测验、人格测验、人工智能和多模态测量。课程既关注统计模型,也强调测量结论的适用条件、公平性和使用后果。通过本课程学习,学生应建立“构念—任务—数据—证据—解释—决策”的完整测量思维,能够选择和评价心理测验,完成基础项目分析与信效度检验,理解现代测量模型的原理和适用范围,并能对教育、临床、组织管理和公共人才评价中的测验问题作出专业判断。教学可综合采用课堂讲授、测验体验、案例辨析、数据练习、量表迭代和小组研讨,强化知识迁移与实践能力。课程思政以科学精神、证据意识、公平责任、人文关怀和终身发展为主线,将价值引导自然融入测验史、测验伦理、常模建立、信效度评价、跨群体比较及人工智能测评。通过“测量证据—价值反思—策略行动—发展反馈”的教学闭环,引导学生既追求测量精度,也对被测者权益、社会公平和专业后果负责。第一章心理测量简史教学重点:中国古代心理测量思想与科举考试中的标准化实践,现代心理测量的起源,以及智力测验、团体测验和人格测验的发展。教学难点:在具体历史情境中理解测量观念、制度实践与现代心理测量理论之间的联系,避免将中西心理测量史简单处理为线性演进。教学内容:§1.1中国古代心理测量学思想先秦至科举时期的知人、察人思想;糊名、誊录等标准化制度;九连环、七巧板、华容道与鲁班锁所体现的能力观察。§1.2中国近代心理测验运动新中国成立前的教育测验运动,以及新中国成立后心理测量的恢复、发展与本土化实践。§1.3现代心理测量的起源个体差异研究、实验心理学、人道主义改革、智力迟滞甄别,以及卡特尔早期心理测量实践。§1.4现代心理测量的发展比奈—西蒙智力量表、军队甲乙种团体测验、自陈问卷、情境测验、投射技术与条件推理测验。教学要求:(一)了解中国古代心理测量思想与科举考试制度中的早期标准化实践。(二)理解近现代心理测量在中国的发展脉络及其社会文化背景。(三)掌握现代心理测量形成的关键人物、事件和代表性测验。(四)能够比较中西心理测量传统的知识组织方式、应用目的与方法特点。(五)能够基于史料评价测验制度对公平、效率和社会流动的双重影响。本章考点:1.中国古代心理测量思想的核心特点及其与西方古代测量思想的异同。2.科举考试中糊名、誊录等制度对评分公平性和标准化的意义。3.比奈—西蒙量表与斯坦福—比奈量表的主要区别。4.第一次世界大战团体智力测验对现代测验实践的影响。本章课程思政建设要点:1.以中国古代知人传统和科举制度为材料,在尊重史实的基础上增强文化主体意识与学术自信。2.通过测验史中的偏见、误用与制度改进案例,理解科学工具必须接受公平与责任的约束。3.引导学生以开放、比较和证据化视角看待本土经验与国际理论,形成求真务实的学术品格。本章参考文献:1.Terman,L.M.(1916).Themeasurementofintelligence.HoughtonMifflin.2.Yerkes,R.M.(1948).PsychologicalexaminingintheUnitedStatesArmy.InW.Dennis(Ed.),Readingsinthehistoryofpsychology(pp.528–540).Appleton-Century-Crofts.(Originalworkpublished1921)3.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.4.张厚粲,&余嘉元.(2012).中国的心理测量发展史.心理科学,35(3),514–521.第二章心理测量概述教学重点:心理测验、心理测量和心理评估的基本概念,行为样本、标准化、客观化与常模等测验要素,以及心理测验的分类、功能和用途。教学难点:理解心理属性不能被直接观察而需通过行为样本进行推断;准确区分测验、测量、评量、评鉴、问卷和量表等相关概念。教学内容:§2.1心理测量的概念心理测验与心理测量的定义和特征;行为样本、标准化、客观化、常模;测验、问卷与量表的区别和联系。§2.2心理测验的类型按照测量目的、受试人数、测量材料、评分方式、结果解释和时间限制对心理测验进行分类。§2.3心理测验的功能与用途甄别、选拔、咨询、诊断、评估、预测和自我发展功能;在教育、临床、组织、公共部门、军事与航天领域的应用。教学要求:(一)掌握心理测验、心理测量和心理评估的定义与关系。(二)理解行为样本、标准化、客观化和常模在测验中的作用。(三)能够依据不同标准对心理测验进行分类,并说明各类测验的适用场景。(四)能够区分测验、问卷、量表、评量与评鉴等术语。(五)能够从测量目的、证据质量和使用后果三个方面评价具体测验应用。本章考点:1.心理测验与心理测量的区别及联系。2.行为样本、标准化、客观化和常模的含义。3.常模参照测验与标准参照测验的区别。4.心理测验在教育、临床和组织管理中的功能及使用边界。本章课程思政建设要点:1.将心理测量理解为“用证据理解人”的方法,培养尊重事实、反对主观臆断的科学精神。2.强调分数是有限行为样本的结果,避免以单一分数给个体贴标签,维护人的尊严和发展可能。3.结合中国公务员考试实践、高考教育评价和心理健康心理测评服务案例,理解科学测量对公平决策和社会治理的价值。本章参考文献:1.AmericanEducationalResearchAssociation,AmericanPsychologicalAssociation,&NationalCouncilonMeasurementinEducation.(2014).Standardsforeducationalandpsychologicaltesting.AmericanEducationalResearchAssociation.2.Anastasi,A.,&Urbina,S.(1997).Psychologicaltesting(7thed.).PrenticeHall.3.Messick,S.(1995).Validityofpsychologicalassessment:Validationofinferencesfrompersons’responsesandperformancesasscientificinquiryintoscoremeaning.AmericanPsychologist,50(9),741–749./10.1037/0003-066X.50.9.7414.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.第三章测验使用伦理教学重点:心理测验误用的形式、后果和成因,影响测验结果的受试者、主试、情境与题目因素,以及测验选择、实施、解释、保密和权益保护。教学难点:在知情同意、隐私保护、测验安全、文化公平和公共利益之间进行规范判断,并把伦理原则落实为可操作的测验流程。教学内容:§3.1如何防止心理测验误用不适当用途、结果误解与非标准化实施;误用对个体、组织和社会的后果;工具质量、人员资质与制度监管。§3.2心理测验的影响因素受试者的生理、认知、情绪、动机、人格和文化背景;主试行为与期望;施测情境和题目特征。§3.3心理测验的使用伦理依据目的选测验、标准化施测与计分、合理解释结果、测验材料保密、知情同意、隐私和数据安全。教学要求:(一)识别心理测验误用的典型形式及其风险。(二)理解受试者、主试、情境和项目因素对测验结果的影响。(三)掌握测验选择、施测、评分、解释和保管的伦理要求。(四)能够针对招聘、教育、临床和网络测评案例提出风险控制方案。(五)能够依据专业标准与个人信息保护要求评价测验实践。本章考点:1.心理测验误用的类型、成因与后果。2.受试者、主试、情境和题目因素对测验结果的影响。3.测验使用者的资质、保密义务和知情同意要求。4.隐私泄露、文化偏见和结果滥用案例的伦理分析。本章课程思政建设要点:1.把受试者权益、人格尊严和最小伤害原则置于测验便利性之上,强化职业伦理。2.通过高风险选拔与临床测评案例培养公平意识、法治意识和责任意识。3.认识数字测评中的隐私、数据安全与算法偏见问题,坚持技术应用中的人类监督。本章参考文献:1.AmericanPsychologicalAssociation.(2020).APAguidelinesforpsychologicalassessmentandevaluation./about/policy/guidelines-psychological-assessment-evaluation.pdf2.InternationalTestCommission,&AssociationofTestPublishers.(2025).Guidelinesfortechnology-basedassessment(Version1.1)./page/283.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.第四章心理测验编制教学重点:标准化测验的准备、题目编制与定型,标准化实施和分数解释,常模团体的确定、取样、常模分数制作及更新。教学难点:把构念界定、测验蓝图、项目设计、试测分析和常模建立连成完整证据链,并处理常模代表性与时效性问题。教学内容:§4.1心理测验的编制确定用途与目标构念,制定编制计划和测验蓝图,形成项目、试测与修订,完成标准化并编写使用说明。§4.2心理测验的实施测验选择与施测准备,主试职责,指导语、环境、计分标准化,以及分数解释的参照框架和注意事项。§4.3测验常模的制作常模和常模团体,代表性取样,常模编制流程,发展常模、组内常模、转换表与剖析图。教学要求:(一)掌握心理测验编制的主要阶段和关键任务。(二)能够依据目标构念编制测验蓝图并撰写规范项目。(三)掌握标准化施测、评分和结果解释的基本要求。(四)理解常模团体的代表性、样本量、取样过程与更新要求。(五)能够完成一个小型量表或测验的初步编制方案,并说明证据收集计划。本章考点:1.心理测验编制的完整流程及各阶段质量控制。2.测验蓝图与项目编制原则。3.标准化施测和分数解释的基本要求。4.常模团体的确定、常模类型及常模分数转换。本章课程思政建设要点:1.通过测验编制全过程训练严谨、可重复和对证据负责的科学态度。2.从常模代表性与项目文化适配出发,理解程序公平是结果公平的重要基础。3.通过项目试测、反馈和迭代修订培养成长性思维,把错误视为改进测量工具的证据。本章参考文献:1.Boateng,G.O.,Neilands,T.B.,Frongillo,E.A.,Melgar-Quiñonez,H.R.,&Young,S.L.(2018).Bestpracticesfordevelopingandvalidatingscalesforhealth,social,andbehavioralresearch:Aprimer.FrontiersinPublicHealth,6,Article149./10.3389/fpubh.2018.001492.Crocker,L.,&Algina,J.(2006).Introductiontoclassicalandmoderntesttheory.CengageLearning.3.DeVellis,R.F.,&Thorpe,C.T.(2021).Scaledevelopment:Theoryandapplications(5thed.).Sage.4.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.第五章经典测验理论教学重点:经典测验理论的形成,观察分数、真分数与误差分数的关系,真分数模型的基本假设、测量误差来源及理论局限。教学难点:理解真分数是重复测量意义上的期望值而非可直接观察的固定实体,并把模型假设与信度、标准误和分数解释联系起来。教学内容:§5.1经典测验理论的起源斯皮尔曼的相关与信度思想,古特曼的误差方差观点,以及洛德和诺维克对真分数理论的系统化。§5.2真分数与测量误差观察分数、真分数与误差分数;随机误差与系统误差;来自测验、评分、施测及受试者状态的误差。§5.3真分数模型假设X=T+E模型及其基本假设;样本依赖性、标准误估计、分数比较和项目反应组型方面的局限。教学要求:(一)掌握经典测验理论的基本术语、模型和假设。(二)理解观察分数、真分数和误差分数之间的关系。(三)能够识别随机误差与系统误差及其主要来源。(四)能够利用经典测验理论解释信度、测量标准误和分数波动。(五)能够比较经典测验理论的优势与局限,并说明现代测量理论的发展动因。本章考点:1.经典测验理论模型X=T+E及其基本假设。2.真分数与误差分数的统计含义。3.测量误差的类型和来源。4.经典测验理论的主要贡献、适用条件与局限。本章课程思政建设要点:1.通过误差概念理解科学判断的边界,形成报告不确定性和避免过度结论的责任意识。2.认识任何一次测验都不能完整定义一个人,培养对个体差异和发展可能的尊重。3.从理论的适用条件与局限出发,养成批判而不否定、继承而能创新的学术态度。本章参考文献:1.Lord,F.M.,&Novick,M.R.(1968).Statisticaltheoriesofmentaltestscores.Addison-Wesley.2.Spearman,C.(1904).Theproofandmeasurementofassociationbetweentwothings.TheAmericanJournalofPsychology,15(1),72–101./10.2307/14121593.Ellis,J.L.,Sijtsma,K.,deGroot,K.,&Groenen,P.J.F.(2024).Reliabilitytheoryformeasurementswithvariabletestlength,illustratedwithERNandPecollectedintheFlankerTask.Psychometrika,89,1280–1303./10.1007/s11336-024-09982-5第六章项目反应理论教学重点:项目特征曲线与IRT基本假设,单参数、双参数、三参数Logistic模型和等级反应模型,项目与能力参数估计,以及IRT的优势和局限。教学难点:结合图形和公式解释能力、难度、区分度与猜测参数;判断单维性、局部独立性与模型拟合,并根据数据和用途选择模型。教学内容:§6.1项目反应理论概述潜在特质与项目特征曲线;能力单维性、局部独立性、知道—答对和非速度限制等基本假设。§6.2项目反应理论模型Rasch或单参数模型、双参数模型、三参数模型和等级反应模型;参数的测量含义与曲线解释。§6.3参数估计与模型评价联合、条件和边际极大似然估计,贝叶斯估计;项目信息、测验信息、模型拟合、优势与局限。教学要求:(一)掌握IRT的基本概念、假设与项目特征曲线。(二)能够解释1PL、2PL、3PL和等级反应模型中的参数。(三)理解常用项目参数与能力参数估计方法的基本思想。(四)能够依据测验用途、题型和样本条件选择适当模型。(五)能够比较IRT与经典测验理论在参数依赖、误差估计和测验设计上的差异。本章考点:1.项目特征曲线及单维性、局部独立性等基本假设。2.1PL、2PL、3PL模型参数的含义与曲线变化。3.等级反应模型的适用题型。4.IRT参数估计、测验信息及其在自适应测验中的应用。本章课程思政建设要点:1.通过模型假设检验培养实证精神,避免把复杂数据交给算法后不加审查。2.讨论参数估计、题库建设与自适应测验中的公平问题,理解技术精度与社会责任必须并重。3.结合我国大规模考试和人才测评实践,认识心理测量技术自主创新与规范应用的重要性。本章参考文献:1.Embretson,S.E.,&Reise,S.P.(2000).Itemresponsetheoryforpsychologists.LawrenceErlbaumAssociates.2.Hambleton,R.K.,Swaminathan,H.,&Rogers,H.J.(1991).Fundamentalsofitemresponsetheory.Sage.3.Reckase,M.D.(2009).Multidimensionalitemresponsetheory.Springer./10.1007/978-0-387-89976-34.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.第七章概化理论教学重点:全域分数、测量侧面和方差分量,概化理论的误差观点,G研究与D研究,单侧面、双侧面、交叉和嵌套设计。教学难点:区分相对决策与绝对决策中的误差及系数,正确识别随机侧面、固定侧面、交叉设计和嵌套设计。教学内容:§7.1概化理论概述全域分数及假定,测量侧面与方差分量,单面交叉与嵌套模型,误差来源与误差种类,G研究和D研究。§7.2单侧面与双侧面设计人员×项目等单侧面设计,人员×项目×评分者等双侧面设计,以及相对和绝对误差方差与系数。§7.3其他测量设计随机侧面与固定侧面、交叉设计与嵌套设计的区别、模型表示和适用场景。教学要求:(一)掌握概化理论的核心概念和多误差来源观点。(二)理解G研究与D研究的目标、步骤和联系。(三)能够区分相对决策与绝对决策及其可靠性指标。(四)能够识别单侧面、双侧面、交叉和嵌套测量设计。(五)能够依据方差分量结果提出增加项目数、评分者数或测量次数的决策方案。本章考点:1.概化理论与经典测验理论在误差观上的区别。2.全域分数、侧面、方差分量、相对误差和绝对误差。3.G研究与D研究的功能及关系。4.交叉设计、嵌套设计及其应用判断。本章课程思政建设要点:1.用多来源误差分析训练系统思维,理解结果往往由个体、任务、评分者和情境共同形成。2.在评价学生、员工或患者时避免归因单一化,增强审慎决策和结果责任意识。3.通过优化测量方案体会资源配置中的科学性与公共责任。本章参考文献:1.Brennan,R.L.(2001).Generalizabilitytheory.Springer./10.1007/978-1-4757-3456-02.Cronbach,L.J.,Gleser,G.C.,Nanda,H.,&Rajaratnam,N.(1972).Thedependabilityofbehavioralmeasurements:Theoryofgeneralizabilityforscoresandprofiles.Wiley.3.Shavelson,R.J.,&Webb,N.M.(1991).Generalizabilitytheory:Aprimer.Sage.4.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.第八章认知诊断理论教学重点:认知属性、Q矩阵与属性掌握模式,DINA、DINO和G-DINA模型,以及认知诊断在教学评估、个性化学习和职业培训中的应用。教学难点:把领域专家知识转化为可检验的Q矩阵,理解补偿与非补偿模型假设,并评价属性分类结果的诊断准确性。教学内容:§8.1认知诊断理论概述认知属性的定义和作用,Q矩阵的构建与数学表达,属性掌握模式及其解释。§8.2常见认知诊断模型DINA、DINO与G-DINA模型的基本假设、参数含义、适用情境和局限。§8.3认知诊断理论的应用精准教学诊断、课堂分组、作业与测验设计、个性化学习、教材开发、教育管理和职业培训。教学要求:(一)掌握认知属性、Q矩阵和掌握模式等核心概念。(二)能够依据学习任务初步界定属性并构建Q矩阵。(三)理解DINA、DINO和G-DINA模型的假设与差异。(四)能够解释个体属性掌握概率和诊断分类结果。(五)能够评价认知诊断在精准教学中的价值、误分类风险和应用边界。本章考点:1.认知属性、Q矩阵和掌握模式的定义与关系。2.Q矩阵构建和验证的基本步骤。3.DINA、DINO与G-DINA模型的异同。4.认知诊断结果在个性化学习和教学改进中的应用。本章课程思政建设要点:1.以具体属性反馈替代简单排名,帮助学习者看到可改进环节,培养成长性思维。2.关注诊断误差、资源差异和反馈方式,避免精准诊断异化为精准标签。3.通过面向不同学习者的教学支持,理解教育公平既包括机会公平,也包括适切支持。本章参考文献:1.delaTorre,J.(2011).ThegeneralizedDINAmodelframework.Psychometrika,76,179–199./10.1007/s11336-011-9207-72.Fu,D.,Qin,C.,Luo,Z.,Li,Y.,Yu,X.,&Ye,Z.(2025).UsingregularizedmethodstovalidateQ-matrixincognitivediagnosticassessment.JournalofEducationalandBehavioralStatistics,50(1),149–179./10.3102/107699862412400843.Rupp,A.A.,Templin,J.,&Henson,R.A.(2010).Diagnosticmeasurement:Theory,methods,andapplications.GuilfordPress.第九章信度教学重点:信度的定义、理论解释和测量模型,重测、复本、内部一致性与评分者信度,信度影响因素、测量标准误及实际应用。教学难点:根据测量目的、数据结构和模型假设选择适当的信度指标,理解α系数的适用条件并避免将高α等同于单维性或有效性。教学内容:§9.1信度的概念信度的广义与理论定义,真分数方差、误差方差和观察分数的关系,平行、τ等价和同质性测量模型。§9.2信度类型及估计方法重测信度、复本信度、分半信度、Cronbachα、二分题系数、标准化α、McDonaldω和评分者信度。§9.3信度的影响因素测验长度与同质性、题目质量、受测群体差异、时间间隔、评分过程和估计方法。§9.4信度的应用测量标准误、个体分数置信区间、差异分数、相关衰减和测验构建与修订。教学要求:(一)掌握信度的核心概念、理论定义和常见测量模型。(二)能够根据测验目的选择并解释重测、复本、内部一致性和评分者信度。(三)能够计算和解释α系数、ω系数及测量标准误。(四)能够分析样本异质性、测验长度和项目质量对信度的影响。(五)能够报告信度证据及其适用条件,避免对单一系数作机械判断。本章考点:1.信度的理论定义及其与随机误差的关系。2.各类信度的适用条件和估计方法。3.Cronbachα的假设、局限及ω系数的补充价值。4.测量标准误、个体分数置信区间与信度的关系。本章课程思政建设要点:1.通过信度与置信区间训练对不确定性的诚实报告,反对只报告有利指标。2.理解可重复性是科学共同体的基本要求,形成数据、方法和结果透明意识。3.在个体决策中避免把细小分数差异解释为真实差异,维护评价公平。本章参考文献:1.Cronbach,L.J.(1951).Coefficientalphaandtheinternalstructureoftests.Psychometrika,16,297–334./10.1007/BF023105552.McNeish,D.(2018).Thankscoefficientalpha,we’lltakeitfromhere.PsychologicalMethods,23(3),412–433./10.1037/met00001443.Sijtsma,K.,&Pfadt,J.M.(2021).PartII:Ontheuse,themisuse,andtheverylimitedusefulnessofCronbach’salpha:Discussinglowerboundsandcorrelatederrors.Psychometrika,86(4),843–860./10.1007/s11336-021-09789-8第十章效度教学重点:效度的概念、性质及其与信度的关系,内容、反应过程、内部结构、与其他变量关系和使用后果等效度证据,以及效度影响因素与补救。教学难点:理解效度针对特定分数解释和用途,而不是测验工具永久不变的属性;整合多来源证据形成效度论证。教学内容:§10.1效度的概念效度的定义、性质和测量学解释;效度与信度的必要而非充分关系。§10.2效度证据及估计方法内容证据、反应过程、内部结构、与其他变量的关系和使用后果;内容效度、效标关联效度与构念效度的传统分类。§10.3效度的影响因素主试与被试、项目内容和形式、施测环境、效标质量、文化语言适配及评估方法;效度改进策略。教学要求:(一)掌握效度的现代定义和基于证据的效度观。(二)理解效度与信度之间的关系。(三)能够区分并收集不同来源的效度证据。(四)能够依据目标解释和用途设计基本效度验证方案。(五)能够评价构念代表不足、构念无关变异和使用后果对效度的影响。本章考点:1.效度的定义、性质及效度与信度的关系。2.效度证据的主要来源及其收集方法。3.内容效度、效标关联效度与构念效度的特点。4.影响效度的因素及改进测验效度的策略。本章课程思政建设要点:1.坚持结论强度与证据强度相匹配,培养实事求是和反对证据滥用的科学精神。2.从测验使用后果审视高风险决策,理解专业判断应同时承担个体和社会责任。3.通过跨文化效度案例培养差异理解和公平意识,避免以单一群体经验作为普遍标准。本章参考文献:1.AmericanEducationalResearchAssociation,AmericanPsychologicalAssociation,&NationalCouncilonMeasurementinEducation.(2014).Standardsforeducationalandpsychologicaltesting.AmericanEducationalResearchAssociation.2.Cronbach,L.J.,&Meehl,P.E.(1955).Constructvalidityinpsychologicaltests.PsychologicalBulletin,52(4),281–302./10.1037/h00409573.Messick,S.(1995).Validityofpsychologicalassessment:Validationofinferencesfrompersons’responsesandperformancesasscientificinquiryintoscoremeaning.AmericanPsychologist,50(9),741–749./10.1037/0003-066X.50.9.7414.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.第十一章项目分析教学重点:项目难度、区分度及项目筛选,社会赞许、默许、伪装、猜测、趋中和随机作答等反应偏差,以及共同方法偏差的来源与控制。教学难点:综合难度、区分度、内容代表性和公平性筛选项目;区分反应偏差、测量误差与共同方法偏差,并选择适当控制方法。教学内容:§11.1难度与区分度项目难度的定义与计算,难度分布对测验的影响;区分度指数、题—总相关及项目综合筛选。§11.2测验反应偏差反应偏差的特点和来源;社会赞许、默许、伪装、猜测、趋中与随机作答的识别和处理。§11.3共同方法偏差共同方法偏差的定义、影响和来源;从程序设计、测量安排和统计分析三个层面进行控制。教学要求:(一)掌握客观题和量表题难度、区分度的基本计算与解释。(二)能够综合统计指标和内容标准筛选、修订项目。(三)识别常见反应偏差并提出程序与统计控制措施。(四)理解共同方法偏差对变量关系和理论检验的影响。(五)能够撰写包含项目分析证据的测验修订报告。本章考点:1.项目难度和区分度的定义、计算与解释。2.优秀项目的特征及项目综合筛选原则。3.常见测验反应偏差的识别和处理。4.共同方法偏差的来源、影响及控制方法。本章课程思政建设要点:1.将数据质量视为科研诚信的重要组成部分,反对选择性删除和事后包装。2.通过项目偏差案例理解统计表现良好不等于内容公平,兼顾技术指标与受测者权益。3.培养可核查、可复现的分析习惯,明确数据清理规则和研究者判断依据。本章参考文献:1.Crocker,L.,&Algina,J.(2006).Introductiontoclassicalandmoderntesttheory.CengageLearning.2.Meade,A.W.,&Craig,S.B.(2012).Identifyingcarelessresponsesinsurveydata.PsychologicalMethods,17(3),437–455./10.1037/a00280853.Podsakoff,P.M.,Podsakoff,N.P.,Williams,L.J.,Huang,C.,&Yang,J.(2024).Commonmethodbias:It’sbad,it’scomplex,it’swidespread,andit’snoteasytofix.AnnualReviewofOrganizationalPsychologyandOrganizationalBehavior,11,17–61./10.1146/annurev-orgpsych-110721-0400304.MichaelFur,李英武,董妍.(2020)著.心理测量学.北京:北京师范大学出版社.第十二章测量等价与测验等值教学重点:测量等价性的概念、类型和理论基础,多组与多层验证性因素分析、DIF、贝叶斯近似与对齐优化方法,以及CTT和IRT测验等值。教学难点:区分构型、度量、标量和严格不变性,理解部分不变性及模型比较;准确区分测量等价、测量不变性、测验等值与量尺链接。教学内容:§12.1测量等价性的概念测量等价性的定义、类型和理论基础,测量等价性与信度、效度及公平比较的关系。§12.2测量等价性的检验方法MG-CFA、ML-CFA、ML-FMM、DIF、贝叶斯近似测量不变性与对齐优化;检验步骤、优势、局限和适用建议。§12.3测验等值与检验方法测验等值的概念和假设,线性、等百分位与IRT等值方法,以及测验等值和测量等价性的异同。教学要求:(一)掌握测量等价性及构型、度量、标量和严格不变性的含义。(二)理解多组验证性因素分析和DIF检验的基本逻辑。(三)能够根据群体数量、样本结构和研究目的选择检验策略。(四)掌握测验等值的基本假设和常用方法。(五)能够评价不等价对均值比较、关系比较和高风险决策的影响。本章考点:1.测量等价性的层级、检验顺序与解释。2.MG-CFA、DIF、贝叶斯近似和对齐优化方法的适用情境。3.部分测量不变性的含义及处理原则。4.测量等价与测验等值的区别,CTT与IRT等值方法。本章课程思政建设要点:1.通过跨群体比较中的等价性检验理解“同一把尺子”的前提,强化实质公平意识。2.尊重文化、性别、年龄和语言背景差异,反对未经验证的直接排名和标签化比较。3.把公平证据纳入测验开发和政策使用全过程,培养公共决策中的专业责任。本章参考文献:1.Kolen,M.J.,&Brennan,R.L.(2014).Testequating,scaling,andlinking:Methodsandpractices(3rded.).Springer./10.1007/978-1-4939-0317-72.Luong,R.,&Flake,J.K.(2023).Measurementinvariancetestingusingconfirmatoryfactoranalysisandalignmentoptimization:Atutorialfortransparentanalysisplanningandreporting.PsychologicalMethods,28(4),905–924./10.1037/met00004413.Meredith,W.(1993).Measurementinvariance,factoranalysisandfactorialinvariance.Psychometrika,58,525–543./10.1007/BF022948254.Sinharay,S.,&Johnson,M.S.(2024).Computationandaccuracyevaluationofcomparablescoresonculturallyresponsiveassessments.JournalofEducationalMeasurement,61(1),5–46./10.1111/jedm.12381第十三章认知能力测验教学重点:认知能力的定义、流体与晶体智力、CHC三层模型,经典智力理论,个体与团体智力测验、能力倾向和创造力测验,以及未来技术与伦理。教学难点:区分一般智力、广义能力与具体能力,理解不同测验分数的解释边界,并处理认知能力测验在人事选拔中的预测效度与公平性。教学内容:§13.1认知能力概述认知能力与传统智力的关系,流体智力和晶体智力,卡罗尔模型与CHC三层结构,认知能力和绩效。§13.2经典智力理论智力因素理论、智力维度理论、三元智力理论、多元智力理论及现代认知心理视角。§13.3认知能力测验的类型比奈—西蒙、斯坦福—比奈、韦氏、CAS等个体测验;团体智力、能力倾向和创造力测验。§13.4未来发展与伦理认知神经科学、人工智能、虚拟现实和云测评平台;测评公平、隐私安全、认知增强和监管。教学要求:(一)掌握认知能力、流体智力、晶体智力和CHC模型的基本内容。(二)理解主要智力理论的核心观点及其对测验设计的影响。(三)能够比较个体智力、团体智力、能力倾向和创造力测验。(四)能够依据教育、职业和临床目的选择适当的认知能力测验。(五)能够评价认知能力测验的预测效度、公平性、隐私和使用后果。本章考点:1.流体智力、晶体智力与CHC三层模型。2.经典智力理论的主要观点及其异同。3.个体智力测验与团体智力测验的特点和适用场景。4.认知能力测验在人事选拔中的价值、局限与公平问题。本章课程思政建设要点:1.结合我国人才选拔实践理解德才兼备、以事择人和科学评价的要求。2.强调能力分数不能替代完整的人格、动机与情境信息,反对唯分数论。3.在承认个体差异的同时关注可塑性、教育支持和发展机会,形成积极的人才观。本章参考文献:1.Carroll,J.B.(1993).Humancognitiveabilities:Asurveyoffactor-analyticstudies.CambridgeUniversityPress./10.1017/CBO97805115713122.McGrew,K.S.(2009).CHCtheoryandthehumancognitiveabilitiesproject:Standingontheshouldersofthegiantsofpsychometricintelligenceresearch.Intelligence,37(1),1–10./10.1016/ell.2008.08.0043.Naglieri,J.A.,&Otero,T.M.(2024).PASStheoryofintelligenceanditsmeasurementusingtheCognitiveAssessmentSystem,2ndedition.JournalofIntelligence,12(8),Article75./10.3390/jintelligence12080075第十四章人格测验教学重点:人格及人格测验的概念和特征,MMPI、CPI、EPQ、16PF、大五人格量表与MBTI等标准化人格工具,以及投射测验的原理、应用和局限。教学难点:理解人格测验是对特质倾向的概率性描述;处理社会赞许、伪装和文化适配问题;区分量表结构、效度证据和应用解释。教学内容:§14.1人格测验概述人格的定义与特征,人格测验的作用和工具,自陈量表的编制逻辑及应用边界。§14.2标准化人格量表MMPI、CPI、EPQ、16PF、大五人格量表、CPAI和MBTI的理论基础、结构、应用与局限。§14.3投射型人格测验投射原理和特点;罗夏墨迹、主题统觉、房—树—人和条件推理测验的实施、计分与评价。教学要求:(一)掌握人格与人格测验的基本概念和主要类型。(二)理解自陈量表和投射测验的原理、优势与局限。(三)能够比较常见人格量表的理论基础、结构和适用场景。(四)能够识别社会赞许、伪装、随机作答和文化差异对结果的影响。(五)能够以多源证据解释人格测验结果,并提出负责任的反馈建议。本章考点:1.人格测验的特点及自陈量表的编制策略。2.MMPI、CPI、EPQ、16PF和大五人格量表的基本特点。3.投射测验的原理、代表性工具及主要局限。4.人格测验在选拔、教育和临床应用中的解释边界。本章课程思政建设要点:1.尊重人格多样性,避免把类型或量表分数固化为人的价值判断。2.在选拔和临床应用中坚持隐私保护、最小必要和多证据决策原则。3.通过跨文化人格研究理解共同性与特殊性的统一,增强文化理解与本土研究意识。本章参考文献:1.McCrae,R.R.,&John,O.P.(1992).Anintroductiontothefive-factormodelanditsapplications.JournalofPersonality,60(2),175–215./10.1111/j.1467-6494.1992.tb00970.x2.Sellbom,M.(2019).TheMMPI-2-RestructuredForm(MMPI-2-RF):Assessmentofpersonalityandpsychopathologyinthetwenty-firstcentury.AnnualReviewofClinicalPsychology,15,149–177./10.1146/annurev-clinpsy-050718-0957013.Soto,C.J.,&John,O.P.(2017).ThenextBigFiveInventory(BFI-2):Developingandassessingahierarchicalmodelwith15facetstoenhancebandwidth,fidelity,andpredictivepower.JournalofPersonalityandSocialPsychology,113(1),117–143./10.1037/pspp0000096第十五章人工智能时代心理测量新范式教学重点:大语言模型、生成式人工智能和Transformer技术,自然语言处理在量表开发、开放文本评分和构念测量中的应用,以及AI测评的效度、可解释性、公平、隐私与监管。教学难点:将语言特征和模型输出连接到清晰心理构念,区分预测准确率与测量效度,并识别训练数据、模型漂移和黑箱决策带来的风险。教学内容:§15.1人工智能与心理测量大语言模型、生成式人工智能、Transformer模型及其在项目生成、自动评分、个性化测验和工具开发中的应用。§15.2自然语言处理与心理测量文本、口语和对话数据;自然语言与量表、自动赋值、语境化语言维度,以及语言特征与心理构念映射。§15.3风险和伦理考量人工智能模型人格与情商评估;可解释性、透明度、泛化、公平、不伤害、责任和隐私原则;法律与监管框架。教学要求:(一)理解大语言模型和自然语言处理改变心理测量的主要机制。(二)能够说明AI在项目生成、自动评分和语境化测量中的应用流程。(三)能够区分模型预测性能与心理测量信度、效度和公平证据。(四)能够识别数据偏差、黑箱决策、模型漂移、隐私和安全风险。(五)能够设计包含人工复核、版本记录和持续验证的AI测评方案。本章考点:1.大语言模型、Transformer和自然语言处理在心理测量中的应用。2.语言特征与心理构念映射的基本逻辑。3.AI测评中预测准确率与测量效度的区别。4.算法可解释性、公平性、隐私和人类监督要求。本章课程思政建设要点:1.坚持科技向善和以人为本,明确AI只能辅助证据形成,不能替代专业责任。2.从数据来源、算法偏差和模型透明度出发培养数字伦理、数据安全和法治意识。3.鼓励面向真实中国情境开展可验证的技术创新,避免技术崇拜与简单照搬。本章参考文献:1.InternationalTestCommission,&AssociationofTestPublishers.(2025).Guidelinesfortechnology-basedassessment(Version1.1)./page/

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

最新文档

评论

0/150

提交评论