社会调查方法第四版课件_第1页
社会调查方法第四版课件_第2页
社会调查方法第四版课件_第3页
社会调查方法第四版课件_第4页
社会调查方法第四版课件_第5页
已阅读5页,还剩187页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

社会调查方法(第四版)风笑天

主编教材社会学研究方法系列第一章

导论第一节

社会调查概述一、社会调查的概念社会调查的定义社会调查是一种采用自填问卷或结构式访问的方法,系统地、直接地从一个取自总体的样本那里收集量化资料,并通过对这些资料的统计分析来认识社会现象及其规律的社会研究方式。•方法:自填问卷或结构式访问•特征:系统地、直接地•数据来源:取自总体的样本•资料性质:量化资料•分析手段:统计分析•目的:认识社会现象及其规律认识对象社会调查的认识对象是社会现象而非自然现象,也非单纯个人,而是由个体组成的群体或社会现象。社会现象

自然现象

单纯个人

群体

系统认识活动社会调查是一种系统的认识活动,包括选题、研究设计、资料收集、资料分析、调查报告撰写等一系列过程。选题研究设计资料收集资料分析调查报告撰写一、社会调查的概念社会调查指的是抽样调查,即从总体中抽取样本,用样本统计结果推断总体,不同于普查、个案调查和典型调查。社会调查主要采用自填问卷和结构式访问两种方式收集第一手资料。社会调查本质上是定量的研究方式,运用社会统计学原理和方法,借助统计软件处理和分析量化资料。社会调查既包括资料收集工作,也包括资料分析工作,是一种独立的社会研究类型。二、社会调查的作用描述状况客观、整体地描述社会现象的基本状况和分布,为进一步研究打下基础。解释原因探讨社会现象背后的原因和机制,回答"为什么会发生"的问题。预测趋势在对现状和原因深入了解的基础上,依据社会发展变化趋势进行一定的预测。三、社会调查的局限01方法论局限社会调查强调客观性和因果联系的普遍性,效仿自然科学范式,但社会现象具有复杂多样性和个体性,社会调查仅是认识社会的方式之一。02实践局限技术性环节可能出现测量有效性问题、抽样代表性问题、统计方法选择适当性问题等。03条件限制社会调查受时间、经费、研究主题合适性等主客观条件限制。04方法挑战随着研究方法多元化发展,扎根理论、定性比较分析、大数据时代的计算社会科学等方法对传统调查方法产生挑战和影响。第二节社会调查的类型一、调查对象的范围:普遍调查和抽样调查(一)普遍调查(1)普遍调查简称普查,是对构成总体的所有个体进行无一遗漏的逐个调查,以了解研究对象在某个时点或时期的总体状况。(2)普查的形式主要有统计报表和建立专门普查机构组织专门调查队伍直接调查登记两种。(3)普查的原则包括统一组织、统一步骤、统一时间、统一普查的项目和指标。(4)普查的特点是成本较高、资料准确性较高、需要统一组织和统一安排、调查项目不宜太多。一、调查对象的范围:普遍调查和抽样调查(二)抽样调查(1)抽样调查是从总体中按照一定方式选取一部分个体进行调查,并以调查结论或数据推断总体的研究方式。(2)抽样调查的特点:是可以用于推断总体的最好且有科学依据的方法;成本低、获取资料迅速、资料详细、应用范围广泛;准确性高,能对抽样误差进行估计。(3)抽样调查的作用:适用于无法进行普遍调查但需量化研究的事物;能检查和修正普遍调查的资料质量。一、调查对象的范围:普遍调查和抽样调查普遍调查和抽样调查的共同点1都采用统计分析方法呈现调查结果,只是复杂程度不同。2目的都是说明总体的基本情况和相关特征。3准确性都比较高,但提高准确性的途径不同。4资料收集工具都具有标准化、可量化的特点。4核心共同点统计分析方法说明总体特征高准确性标准化工具二、应用领域:行政统计调查、学术性调查、民意调查、市场调查行政统计调查多由国家或各级政府组织开展,内容涉及人口、资源、行业、社会概况等,多为大规模的宏观概况性调查。学术性调查由科研机关或大学组织开展,从最初的描述性调查发展到解释性研究,广泛应用于社会科学各领域。民意调查采用抽样调查方法调查人们对社会现象、社会问题或舆论热点的意见、态度等主观意向,方式呈现多样化和数字化趋势。市场调查由企业或专业市场调查公司实施,为企业生产和销售服务,调查内容广泛,方法多样。三、历史或内涵:传统社会调查与现代社会调查传统社会调查最早运用于行政统计调查领域,可追溯到古代埃及和中国的人口统计,如《尚书·禹贡》记载的九州表。现代社会调查18世纪以后伴随资本主义制度建立和社会问题增多而产生,19世纪到20世纪初出现了一批著名社会调查学家,20世纪特别是第一次世界大战后社会调查中心转移到美国,20世纪二三十年代后调查领域进一步扩大。三、历史或内涵:传统社会调查与现代社会调查按内涵划分思想渊源不同传统社会调查遵循人文主义传统,现代社会调查遵循实证主义传统。调查方式不同传统以典型调查和个案调查为主,现代以抽样调查为主。资料收集方式不同传统主要采用座谈会、无结构自由访谈,现代主要采用封闭式问卷的自填问卷或结构式访问。资料处理和统计方法不同传统采用定性分析,依靠归纳、思辨、主观方法;现代运用定量分析技术,依靠演绎、统计、客观、实证方法。适用领域不同传统适用于同质性较高、流动性较小、社会变迁速度较慢的社会;现代适用于异质性较高、流动性较大、社会变迁速度较快的社会。四、社会调查的其他分类按调查目的或作用划分1描述性调查2解释性调查3预测性调查按收集资料的方法划分问卷调查自填问卷和邮寄问卷访问调查面对面访问和电话访问第三节

社会调查的一般程序一、选题阶段选择调查问题是社会调查的起点包括确定一个调查问题和将调查问题具体化、精确化调查问题要求有价值、有创新并且有可行性价值包括理论价值或现实价值二、准备阶段调查设计1调查思路确定整体调查方向与逻辑框架2调查策略制定实施计划与资源配置方案3调查方法选择定性或定量研究路径4具体技术落实数据采集与分析工具工具准备设计问卷根据调查目标,编制结构化问题清单,确保数据收集的针对性与有效性三、调查实施阶段主要任务根据调查设计确定的思路、策略、方式和方法,对特定调查对象进行资料收集工作。核心:资料收集阶段重要性此阶段是社会调查中最复杂也最重要的环节,工作质量对成果质量产生关键影响,必要时可对研究设计进行适当修正。关键:质量影响成果·可修正设计四、分析阶段原始资料处理主要对调查收集到的原始资料进行处理、复核、录入、统计、分析等工作。处理复核录入统计分析定量资料分析指对定量资料的整理和统计分析,定性资料的整理及分析不在本书讨论范围。本书范围定量资料的整理和统计分析五、总结(报告)阶段主要任务撰写调查报告、评估调查质量、应用调查成果。调查报告内容既包含数据分析结果,也包含调查工作的简要介绍和评价。本书结构按照社会调查的五个阶段顺次展开。第二章

调查课题的选择和调查设计第一节

社会调查选题一、调查课题的类型(一)关注点:理论性课题和应用性课题(1)理论性课题侧重于产生、发展关于社会的基本知识,特别是建立或检验各种理论假设。(2)应用性课题侧重于描述、了解和探讨各种社会问题或具体社会现象,落脚点是现实问题。(二)来源:自选课题和委派课题(1)自选课题是研究者根据自己的研究领域、方向和兴趣或实际工作需要选定的课题,具有较大自主性。(2)委派课题是由政府机构、部门、企事业单位或个人确定并委托或指派给研究者的课题。(3)有些选题介于两者之间,如各类基金课题,既有规定性和方向性,又给予研究者相当的灵活性和自主权。二、选题的标准1重要性指调查课题所具有的理论意义或实践价值,用处越多越大的课题越是好课题。2创造性指调查课题具有新的东西和独特之处,能在某些方面增加新的知识。3可行性指研究者是否具有完成调查的主客观条件,包括自身条件限制和外在环境或条件限制。4合适性指调查课题最适合研究者个人特点,能让研究者充分发挥各方面优势。三、选题的途径和方法从现有文献中寻找带着审视、批判的眼光阅读文献,或进行广泛联想,从而产生思考和疑问,形成课题灵感。从个人经历中寻找个人的经历和经验提供了观察社会生活的特定视角,从习以为常的现象中发现新问题。从社会生活中寻找善于观察、勤于思考,从身边习以为常的现象和事物中发现研究的切入点。从政策需求和社会热点中寻找关注政府工作报告、政策文件、行业规划,关注权威新闻媒体和社交媒体平台的热点信息。四、调查课题的明确化课题明确化的定义课题明确化是指对调查课题进行界定,给予明确陈述,将最初含混的想法变成明确清晰的调查主题。课题明确化的方法1通过缩小问题的内容范围使课题逐步明确化2用变量的方式突出基本变量或关键变量,用变量的语言陈述课题课题明确化的原则"从大处着眼,从小处着手",既要保证选题的意义和价值,又要保证可操作性。五、文献查阅与选题文献查阅的作用帮助研究者了解该领域的研究状况和已取得的研究成果,确定自己的调查课题在该领域的位置和意义。为研究者提供可行的研究思路或研究方法,借鉴前人经验,避免不足或缺陷。培养研究者的批判性思维和分析能力,为做好调查研究奠定基础。五、文献查阅与选题文献检索包括著作、统计资料和档案材料、论文的检索,常用滚雪球法。文献筛选根据文献的相似性、文献发表的时间、文献作者的权威性和影响力等因素筛选。文献阅读和分析重点阅读每项研究的研究背景和框架、研究方法、研究结果和结论,阅读时做好标记、评论和摘录。第二节

社会调查设计一、按调查目的所分的社会调查类型探索性调查•指对所研究的现象和问题进行初步了解,以获得初步印象和感性认识的调查。•用于大型调查前的试调查、研究者对研究问题了解较少时、或调查涉及的现象不太为人所知时。•对调查方法要求不严格,抽样往往是非概率抽样,样本规模较小,以无结构式访问收集资料。一、按调查目的所分的社会调查类型描述性调查指对某些总体或社会现象进行描述的调查,目的是揭示总体在某些特征上的分布状况。以抽样调查方式进行,样本规模较大,以封闭式问题为主,采用自填问卷、邮寄问卷或结构式访问收集资料。认识比探索性调查更全面、完整和系统。一、按调查目的所分的社会调查类型解释性调查•指用于发现和说明社会现象或社会问题的原因、揭示社会现象之间关系的社会调查。•往往有较强的理论色彩,从一定理论出发演绎出研究假设,用定量调查收集资料并验证假设。•抽样方式、资料收集和分析方法与描述性调查一样,但设计更严密、更有针对性。二、分析单位分析单位的概念分析单位是社会调查中所研究的对象,资料描述的是分析单位中的每个个体。分析单位不同于调查对象、研究内容和研究主题,调查对象是收集资料时直接询问的对象,研究主题是分析单位的属性或特征。二、分析单位个人社会调查中用得最多的分析单位类型,通过对个人的描述和汇总推论,可以描述和解释由个人组成的群体及各种社会现象。群体由若干个人组成的各种社会群体,如班级、家庭、邻里、朋友群体等,也可成为分析单位。组织正式群体中的一种,如企业、机关、学校、医院等,可以成为分析单位。社区生活在同一地理区域内、具有共同意识和共同利益的人们的生活共同体,如乡村、集镇、街道、城市等。社会产品涉及人类行为及其结果的各个方面,包括实物类型、行为类型和更抽象的类型。二、分析单位层次谬误用一种较大的集群分析单位做研究,但用另一种较小的或非集群的分析单位做结论。核心问题:分析单位与结论单位不一致,导致从群体特征错误推断个体特征典型表现:以"国家""社区"等宏观单位收集数据,却得出关于"个人""家庭"等微观单位的结论简化论用个体层次的资料和结论来解释宏观层次的现象。核心问题:分析层次过低,忽视社会结构、制度等宏观因素的独立作用典型表现:将社会现象完全还原为个人心理或行为,忽略集体层面的emergentproperties三、时间维度横向调查指在一个特定的时间点收集资料,并对该时间点的现象进行研究,或探讨该时间点上不同变量之间的关系。纵向调查趋势研究对一般总体随时间推移而发生的变化所进行的研究。同期群研究对某个特殊人群随着时间推移而发生的变化所进行的研究,每次研究的具体对象可以不一样。同组研究对同一批研究对象进行追踪,研究他们随着时间推移而发生的变化,每次调查所用的都是同一个样本。四、具体方案调查目的与内容1.说明调查课题的目的和意义。2.说明调查的内容:对调查目的进行细化和具体分解。理论假设与分析单位3.说明调查的理论假设:解释性调查必须事先建立理论假设。4.说明调查的分析单位和抽样方案:界定总体、说明具体抽样方法和程序、界定样本规模。方法、人员与进度5.说明研究资料的收集方法与分析方法。6.说明调查人员的组成、组织结构及培训安排。7.确定研究的时间进度和经费使用计划。第三章

抽样第一节

抽样概述一、抽样的概念总体与样本(1)总体是根据特定的研究目的和要求所确定的研究对象的全体,具有同质性、大量性和差异性三个显著特征。(2)样本是从总体中按一定方式抽取出的部分元素的集合。抽样与抽样单位(3)抽样是从组成某个总体的所有元素的集合中按一定方式选择或抽取样本的过程。(4)抽样单位是进行一次直接抽样时所采用的基本单元,抽样框是总体内所有抽样单位的完整名单。参数值与统计值(5)参数值是关于总体中某一变量的综合描述,统计值是关于样本中某一变量的综合描述,抽样的目的就是通过样本值去估计和推断总体的参数值。二、抽样的作用抽样的五大作用1抽样提供了"由部分认识总体"的有效途径和手段。2抽样调查能节省大量人力、财力和时间。3抽样调查允许对抽取的样本进行更为深入的研究。4抽样调查能避免对总体中更多个体造成不必要的影响甚至损害。5良好的抽样方法能显著减小人为误差。三、抽样的类型概率抽样(随机抽样)遵循随机化原则,每个样本元素被选中的机会均等,包括简单随机抽样、系统抽样、分层抽样、整群抽样和多阶段抽样。非概率抽样(非随机抽样)依赖于研究者的主观判断、意愿或便利性,每个元素被选中的机会不均等,包括偶遇抽样、判断抽样、定额抽样和滚雪球抽样。第二节

概率抽样方法一、简单随机抽样简单随机抽样的核心特征1遵循等概率原则,直接从含有N个元素的总体中随机抽取n个元素组成样本。2分为重复抽样(回置抽样)和不重复抽样(不回置抽样)两种。3通常通过抽签法或查随机数表法完成。4简单随机抽样在总体规模较小时简便实用,但总体单位数众多时费时耗力、成本较高。关键要点核心原则等概率随机抽取抽样方式重复/不重复实施方法抽签法/随机数表法适用场景总体规模较小二、系统抽样定义与操作步骤(1)先将总体的每一个单位按某种与总体特征标志无关的顺序编号,然后计算出抽样间距,按照固定间距逐一抽取单位组成样本。(2)抽样间距由总体规模与样本容量的比率决定,起始数字必须随机确定。优势与风险(3)与简单随机抽样相比更简便易行,在社会研究中更广泛采用。(4)但存在风险:当总体名单的排列与研究变量呈现相关性规则分布时,样本可能产生较大偏差。三、分层抽样1首先依据对观察指标有显著影响的某种特征将总体分为若干类型或层次,然后在每个类型或层次中抽取一定数量的观察单位,最终合并构成样本。2分层标准应优先考虑与分析和研究的主要变量或相关变量密切相关的因素,应选取能增强层内同质性、层间异质性的变量。3各层抽取的样本数占全部样本数的比例通常应与各层个体数占总体个体数的比例保持一致。4分层抽样遵循了"从异质总体中抽取样本所产生的抽样误差要小"的原理,在不增加样本规模的前提下降低了抽样误差。四、整群抽样整群抽样(1)从总体中随机抽取若干小群体,进而由这些小群体内的所有元素构成样本。(2)抽样单位并非单个个体,而是成群的个体。(3)优势在于样本比较集中,能显著节省时间、人力与财力;无需获取总体元素的完整名单。(4)局限性在于过于集中于特定的群组,涉及面较窄,可能导致样本代表性不足。五、多阶段抽样多阶段抽样的定义与操作流程1定义按照抽样元素的隶属关系或层次关系,将抽样过程划分为若干阶段逐步进行。2基本操作流程从总体中随机抽取若干大群,再在这些大群内抽取小群,层层推进直至抽到最基本的元素构成样本。适用场景与误差控制3适用场景适用于范围特别广、对象层次特别多的社会研究。4误差特点与控制策略由于每级抽样都可能产生误差,多阶段抽样比其他概率抽样方法产生的抽样误差大,可通过增加开头阶段样本数而适当减少最后阶段样本数的策略来减少误差。第三节

非概率抽样方法一、偶遇抽样偶遇抽样1调查者根据现实情况,在一定时间和特定环境里,将所能遇见或接触到的人作为样本。2不是随机抽样,没有保证总体中每一个元素都有同等的被抽中的机会。3样本具有很大的偶然性,代表性较差,不能用来推论总体,但方便省力,常用于探索性研究中的试调查。核心特征非随机性无同等被抽中机会偶然性大代表性较差方便省力探索性研究/试调查二、判断抽样定义与目标1调查者根据研究目标和自己的主观分析来选择和确定样本2样本选择应致力于获得关于研究主题最全面、最多元的信息和观点条件与权衡3运用效果在很大程度上取决于研究者的理论素养、实际经验、对总体的了解程度以及判断能力4省略了编制抽样框等前期程序,节省时间又节约成本,但无法保证样本的代表性三、定额抽样定额抽样的核心特征与操作步骤调查者首先确定要抽取的样本数量,然后按照既定的标准和比例分配样本,最后从符合标准的对象中任意地抽取样本。需要尽可能依据可能影响研究变量的因素对总体进行分层,并明确具有各种不同特征的成员在总体中所占的比例。比偶遇抽样和判断抽样所抽取的样本更具代表性,在市场调查和广告调查中应用广泛。定额抽样与分层抽样的区别目的不同:定额注重表面一致性,分层要提高代表性减小误差抽样概率不同:定额按条件寻找,分层客观等概率抽样四、滚雪球抽样核心步骤初始步骤是选取少量的甚至是单个的调查对象进行访问,然后通过这些已访问的对象发掘并引入新的调查对象,不断重复,调查范围逐渐扩大。适用场景特别适用于总体的个体信息不充分、难以获得,或无法使用其他抽样方法有效抽取样本的情形。在某些特殊群体的调查中往往能发挥奇效。局限性与注意事项所获得的样本往往缺乏代表性,使用时需谨慎评估可能带来的局限性和误差。重要提醒样本代表性不足是滚雪球抽样的核心风险,研究结论外推时需特别审慎第四节

样本规模的确定一、样本规模样本规模定义样本规模指的是进行抽样研究所必需的抽样单位数目。样本量与代表性关系样本量越大,代表性越强,越能准确反映总体的特征样本量越小,代表性越差样本规模要求与公式社会研究中的样本规模不应少于100个。推论总体均值的样本规模公式:n=t²×σ²/e²推论总体百分比的样本规模公式:n=t²×ρ(1-ρ)/e²二、影响样本规模确定的因素总体规模在精确度要求一定的情况下,样本规模与总体规模通常成正比,但总体规模非常大时,样本规模不按比例增加。总体的异质性程度同质性程度高的总体所需样本规模相对较小,异质性程度高的总体需要更大的样本规模。推断的把握性与精确性要求置信度越高,所需样本规模越大;置信区间越小,所需样本规模越大。抽样误差抽样误差与样本规模成反比,允许的抽样误差越大,所需样本规模越小。经费、人力和时间实际研究中的样本规模还受到研究者所拥有的经费、人力和时间等现实因素的制约。第四章

测量第一节测量的概念与特征一、什么是测量测量就是根据一定的法则,将某事物或现象所具有的属性或特征用数字或符号表示出来的过程。社会测量是把抽象概念用人们具体可见的方式表示出来的过程。二、测量的四个要素1测量客体测量的对象,对应"测量谁"的问题。2测量内容测量客体的某种属性或特征,对应"测量什么"的问题。3测量法则用数字或符号表达事物各种属性或特征的统一标准,对应"怎么测"的问题。4数字或符号用来表示测量结果的工具,对应"如何表示"的问题。三、社会测量的特征社会测量受人为因素影响较大,有一定的主观性。社会测量对同一对象的同一测量内容可能有不同的测量法则,缺乏标准化和统一性。社会测量有一定的模糊性,难以达到自然科学那样高的量化和精确化程度。第二节

测量的层次一、定类测量也称为类别测量或定名测量,是测量层次中最低的一种本质上是分类体系将研究对象的不同属性或特征加以区分,标以不同的名称或符号,确定其类别数学特征主要是等于和不等于(或者属于和不属于)类别原则所分的类别既要具有穷尽性,又要具有互斥性核心特征总结别名类别测量/定名测量层次定位测量层次中最低的一种数学运算等于/不等于(属于/不属于)二、定序测量也称为等级测量或顺序测量,可以按照某种逻辑顺序将研究对象排列出高低或大小,确定其等级及次序1数学特征是大于或小于,比定类测量高一个层次2具备不对称性和传递性三、定距测量也称为等距测量或区间测量能将社会现象或事物区分为不同的类别和等级,并确定不同等级的间隔距离和数量差别。测量结果可以进行加减运算。定距测量的值可以为0,但这个0不具备数学中0的含义。0定距测量的特殊零点这个0不具备数学中0的含义,仅作为位置标记而非"无"四、定比测量定比测量•也称为等比测量或比例测量,具有上述三种测量的全部性质,还具有一个绝对的零点。•测量结果既能进行加减运算,又能进行乘除运算。+−×

÷绝对零点测量层次最高四种运算均可进行五、小结四种测量的层次由低到高逐渐上升高层次测量具有低层次测量的所有功能在对社会现象进行测量时,尽可能进行高层次的测量但选择取决于测量目的、测量对象的特征和现实情况根据测量结果的量化程度测量可区分为离散测量和连续测量第三节

操作化一、操作化的几个相关概念及其关系概念与变量概念是对事物本质属性的抽象概括,是构建理论的基本要件,有概念定义和操作定义之分。变量是包括两个及以上取值或范畴的概念,可分为自变量、因变量、控制变量、中介变量和调节变量,也可分为连续变量和离散变量。指标、量表与变量形式指标是表示一个概念或变量含义的一组可观察到的事物,量表是由多个具有逻辑结构或经验结构的项目组成的复合测量。指标和量表是相对于抽象程度较高的概念来说的,一旦抽象概念通过指标或量表得到测量,就取得了变量的形式。二、操作化的含义与作用操作化的含义操作化是将抽象的概念转化为可观察的具体指标的过程,是对那些抽象层次较高的概念进行具体测量所采用的程序、步骤、方法、手段的详细说明。操作化是社会研究中由理论到实际、由抽象到具体这一过程的"瓶颈",是沟通抽象的理论概念与具体的经验事实的桥梁。操作化的作用1有助于提高社会调查研究的客观性2可促进形成对研究问题的统一性认识3有利于增强社会调查研究的可比性三、操作化的过程与方法概念的澄清和界定1概念的澄清和界定包括对概念本身进行界定和在此基础上建立概念的操作化定义。2通过查阅文献了解有关概念的各种不同定义,进行分类、总结和归纳,然后做出自己的界定。3操作性定义是建立一些具体的程序或指标来说明如何测量一个概念。核心要点概念界定是操作化的基础,需先明确概念内涵文献梳理有助于辨析不同定义的适用情境操作性定义将抽象概念转化为可测量的具体指标三、操作化的过程与方法列出概念的维度维度是指概念的具体方面或层面,属于理论范畴。建立测量指标可以通过寻找和利用前人已有的量表或指标,也可以自行进行探索性工作,采用实地观察和无结构式访问等方式收集资料,发展测量指标。四、指标选择的多样性对相同的概念存在不同的界定方法对一个概念的相同界定存在不同的操作化维度和指标体系对不同概念的测量存在相同的或相似的操作化维度和指标体系五、三角测量定义三角测量法是指结合使用不同的研究资料、研究人员、研究理论和研究方法来对同一个研究问题进行分析的研究策略,目的是提高评估测量的效度和完备性。四种类型1.理论三角测量法2.数据三角测量法3.方法三角测量法4.研究员三角测量法六、操作化示例——婚姻质量的测量西方比较著名的婚姻质量度量设计婚姻调适测试(MAT)双方调适量表(DAS)婚姻满意度量表(MSS)婚姻质量指标(QMI)堪萨斯婚姻满意度量表(KMSS)OLSON婚姻质量量表包括婚姻调适测试(MAT)、双方调适量表(DAS)、婚姻满意度量表(MSS)、婚姻质量指标(QMI)、堪萨斯婚姻满意度量表(KMSS)、OLSON婚姻质量量表第四节

量表一、总加量表总加量表构成与特点1构成方式由一组反映人们对事物态度或行为的陈述项目构成,回答者分别发表意见,根据答案分别计分,然后将全部项目上的得分加起来。2测量特性每个陈述项目所表示的态度或行为方向一致,每个项目具有同等的测量效度。3优缺点优点是使用简便、适用广泛;缺点是单纯以总分评价,可能在总分相同的情况下掩盖实际内容的不同。二、李克特量表李克特量表(1)由一组对某事物的态度或看法的陈述组成,回答被分成"非常同意""同意""不知道""不同意""非常不同意"五类。(2)是社会研究中用得最多的一种量表形式。(3)提出了一种帮助研究者从量表中消除有问题的项目的方法,基本程序包括提出测量问题、进行测量试验、统计总分、评估试验结果并制定正式量表。三、语义差异量表语义差异量表1由处于两端的两组意义相反的形容词构成,每一对反义形容词之间分为7~11个等级区间。2主要运用于文化的比较研究、个人及群体间差异的比较研究,以及人们对周围环境或事物的态度、看法的研究等。3实施程序简单,作答方便,评分方法固定客观,方便计算机处理。第五节

信度和效度一、信度信度信度是指测量数据和结论的可靠性程度,即测量工具能稳定地测量到它要测量的事项的程度。信度的三种类型1.再测信度:对相同的测量对象运用同一套测量工具在不同的时间点先后测量两次,计算两次测量结果的相关系数。2.复本信度:设计两份测量同一概念的问卷,对同一群对象同时进行测量,根据两份问卷所得结果计算相关系数。3.折半信度:无复本且不准备重测的情况下,将测量项目随机分成两组,计算两组的相关系数。二、效度效度测量的准确度或有效度,即测量工具在多大程度上反映了我们想要测量的概念的真实含义01表面效度(内容效度)检查测量内容的适当性,鉴别测量内容是否反映了概念的基本内容02准则效度(实用效度)将新的测量结果与作为准则的原有有效测量方法的结果相比较03建构效度(理论效度)了解测量工具是否反映了概念和命题的内部结构,通过与理论假设相比较来检验三、信度和效度的关系信度是效度的基础,效度则是信度的目的和归属信度低效度不可能高信度高效度未必高效度低信度很可能高效度高信度也必然高第五章

问卷设计第一节

问卷的概念及其结构一、什么是问卷问卷的定义问卷是社会调查的资料收集工具,是一套有目的、有系统及有顺序的问题表格设计。问卷的分类1.按资料收集方式:问卷可分为自填问卷和访问问卷。2.按形式:问卷可分为印刷的纸质文字型问卷和电子化的网络问卷。二、问卷的基本结构标题用一句话简明扼要地概括调查的主题和问卷内容,要求非常通俗、简单明了。封面信调查者写给被访者的简短信函,简要说明调查的基本情况,包括身份和组织单位、研究内容和目的、抽样方法以及保密原则等。指导语用来指导被调查者填答问卷的各种解释和说明,包括回答范围、回答方法、指导回答过程、概念的解释等。问题和答案问卷的主体,包括封闭式问题、开放式问题和半开放半封闭式问题;按内容分为事实型问题、行为型问题和意见型问题;按题型分为填空题、选择题等。编码和其他资料编码是赋予每一个问题及其答案一个数字作为代码;还包括访问情况表和访问意见表等。第二节

问卷设计的原则与步骤一、问卷设计的基本原则出发点——为被调查者着想被调查者要能够回答问题问题不超出被访者的知识背景、理解能力和认知范围。被调查者愿意回答避免被访者不感兴趣、觉得复杂麻烦、涉及个人隐私、不适合被访者客观背景的问题。以被调查者为中心问卷设计的核心在于站在被调查者角度思考,确保问题既在其能力范围内,又能激发其参与意愿一、问卷设计的基本原则立足点——研究假设的验证问卷设计不是孤立的,而是整体研究框架中的有机组成部分,需要"前思后想",前面连接概念测量和操作化,后面考虑后期的资料统计分析。概念测量操作化→问卷设计核心环节→资料收集统计分析核心原则1有机组成部分——问卷设计嵌入整体研究框架,非孤立环节2"前思"——前置连接概念测量与操作化定义3"后想"——后置预留统计分析的可行性空间一、问卷设计的基本原则根本点——保证信度和效度•信度指测量的一致性,确保每个人都回答相同的问题,并在有限的答案中做出"被迫式"的选择。•效度表明问卷中设计的问题和对概念的操作化与研究问题之间的对应程度。核心要义信度解决"测量是否稳定一致"的问题——同一问卷反复测量应得到相同结果效度解决"测量是否准确有效"的问题——问卷内容必须真实反映研究目标两者缺一不可:无信度则数据不可靠,无效度则测量无意义二、问卷设计的步骤探索性工作包括实践上的探索性访谈工作和理论上相关文献的查阅。探索性访谈的意义:·避免设计出不符合实际的问题或答案;·从被访者那里总结出基本的答案;·使问题更具体。二、问卷设计的步骤卡片法将探索性工作得到的问题及答案逐一写在卡片上,按主题分类,按逻辑结构排序,是一种先分后总的设计思路。框图法先画出整个问卷的各个组成部分及前后顺序的草图,然后写出每一部分的问题及答案,是一种先总后分的模式。二、问卷设计的步骤试用将问卷初稿进行试调查,可以发现和改正不合适的问题,设计更加合理的答案,纠正含混不清和抽象的表述。修改问卷,排版定稿并印刷从问题的设计、答案的设计、语言的表达、形式与布局、顺序的调整、文字校对六个方面入手修改。第三节

问卷的设计一、问题的设计填空题直接让被访者填写数字或文字的题目,一般询问容易回答且容易填写的问题。选择题包括二项单选、多项单选、多项多选、多项排序、矩阵式(表格式)、相倚问题等。一、问题的设计问题设计的基本原则清楚、明确、具体。一次只问一个问题。客观中立,不能带有倾向性。不直接询问隐私或敏感问题,可运用将问题放在问卷末尾、运用第三人称、模糊化处理、大众化、随机问答法、设计辅助题目等技巧。问题和答案协调。二、答案的设计答案完备性每个被访者都有一个适合其情况的选项可选。答案互斥性每个答案选项相互独立,没有交叉。答案等级的明确性答案的设计要决定变量的测量层次,避免使用缺乏明确数量含义的频率词。答案中立答案设计也要遵循客观中立原则。主观性问题的答案设计考虑答案数量问题、中间答案设置与否的问题、答案的排列顺序问题。三、问卷的语言表达语言简练避免烦琐复杂的句式、句法。通俗易懂适合被访者的特征。避免含混不清避免含混不清的字眼。避免术语缩略语尽量不要使用术语、缩略语或特殊用语。避免双重否定避免双重否定的句式。避免歧义避免产生歧义。四、问卷的编排与格式(一)问题的排列顺序(1)引起被访者兴趣的问题放在前面,敏感性问题和开放式问题放在后面。(2)被访者熟悉的、易于回答的问题放在前面。(3)先问行为等方面的客观问题,后问态度、价值观等方面的主观问题。(4)按逻辑次序排列问题。(5)避免建立反应倾向。四、问卷的编排与格式(二)问卷的布局与排版1字体字号:一般用宋体打印,字号根据问卷长短和被访者特征决定。2行间距:可以增加行距使问卷更清晰。3答案横排和纵排:横排节约版面,纵排更清晰。4问题和答案排在一页。5一些细节:页面设置、纸张质量、每页印顺序号,特殊强调可用不同字体,开放式问题留下足够填写空间。第四节

问卷评估与修改一、问卷评估(一)主观评估法邀请问卷设计专家、调查方法专家、心理学家、研究内容领域的专家、典型的被调查者对问卷进行评价并提出修改意见。(二)客观评估法将问卷初稿打印20~50份进行试调查,通过对漏填、错填、回答无变化等情况的检查和分析,以及计算问卷的回收率和信度、效度来评价问卷质量。二、问卷设计中的常见错误及修改概念抽象通过定义澄清、用多个题目分解、六要素明确法处理问题含糊表述不够清晰具体表述有倾向性诱导被访者做出偏离客观情况的答案双重或多重含义包含不止一件事情问题和答案不协调问题询问的内容和所列出的答案不一致三、如何提高问卷设计的质量好问卷的标准有较高的信度和效度。适合被访者,回收率和有效回收率高。如何提高问卷设计的质量1为被调查者着想。2综合考虑多种问卷设计的影响因素。3保持严谨的科学态度,精益求精。4打好文字表达能力和社会生活常识等相关知识基础。第六章

资料收集第一节

资料收集方法的类型及其特点一、资料收集方法的类型自填问卷法调查员将问卷发送给被调查者,由被调查者自己阅读和填答,再由调查员收回问卷,本质特征在于由被调查者自主完成问卷。•个别发送法•邮寄填答法•集中填答法•网络调查法结构式访问法调查员依据事先设计好的调查问卷,采取口头询问和交谈的方式收集资料,本质特征是调查员依据调查问卷提问并记录。•当面访问法•电话访问法•即时通信软件访问法二、自填问卷法与结构式访问法的特点自填问卷法的特点优点节省时间、经费和人力;具有很好的匿名性;减少人为误差。缺点问卷的回收率有时难以保证;对被调查者的文化素养有一定要求;调查资料的质量存在潜在风险。结构式访问法的特点优点调查的回收率比较高;调查资料的质量较好;调查对象的适用范围广。缺点调查员与被调查者之间的互动有时会影响到调查结果;访问调查的匿名性比较差;访问调查的费用高、代价大;对调查员的要求更高。第二节

自填问卷法一、个别发送法个别发送法1.调查员将问卷逐个发放到被调查者手中,讲明调查的目的和要求,约定收取的时间、地点和方式。2.介于邮寄填答法和结构式访问法之间,较好地处理了调查的质量与数量之间的关系。3.比较节省时间、经费和人力,能保证比较高的回收率,具有一定的匿名性。二、邮寄填答法研究者将印制好的问卷邮寄给被调查者,待填答后再寄回优点•特别省时、省力、省钱•调查范围最广,不受地域限制•被调查者可在方便时从容填答缺点•需要有调查对象的地址和姓名•问卷的回收率难以保证注意事项•慎重考虑调查主办者的身份•封面信要郑重正式•考虑邮寄时间•以跟踪信或提醒电话帮助提高回答率三、集中填答法集中填答法①通过某种形式将被调查者集中起来,统一讲解调查要求,当场填答问卷,统一收回。②比个别发送法更节省时间、人力和费用;比邮寄调查法更能保证问卷填答的质量和回收率。③缺点:适用集中填答法的调查对象比较少;调查对象的集中可能影响他们如实地填答问卷。四、网络调查法网络调查法定义指研究者利用互联网向特定的对象发送调查问卷,再通过互联网将被调查者填答好的问卷收回。常见方式•将问卷链接在网站网页上供上网者填答;•先确定总体收集邮箱,发送邮件附问卷链接;•通过电子邮件、腾讯QQ、微信等将问卷发送给被调查对象。优点方便快捷、节省费用。不足•调查对象的范围有限,只能调查有上网条件同时也会上网的对象;•需要特定的计算机技术和网络技术支持。第三节

结构式访问法一、当面访问法当面访问法调查员携带调查问卷赴各调查地点,按照要求对被调查者进行面对面访问,并记录各种回答。优点•调查员能对调查过程加以控制,提高结果可靠性•问卷回答率很高•能对调查资料的真实性进行评估缺点•调查费用远远高于自填问卷法•所花费的时间远远长于自填问卷法•效果有时不如自填问卷法二、电话访问法定义调查员通过打电话的方式与被调查者联系并进行访问,需要计算机辅助电话访问系统的支持。优点•十分迅速;•相对简便易行,比较省钱;•便于对调查员进行监督和控制。缺点•在被调查者的选取及代表性方面存在困难;•调查的时间不能太长,通常控制在10分钟以内。三、即时通信软件访问法调查员在网络上通过即时通信软件与被调查者取得联系,并运用在线聊天和交流功能进行访问优点·快捷、不受时空限制、成本低;·信息传输方式具有多样性,且信息内容会自动保存。缺点·难以获得明确的抽样框,样本的代表性不足;·访问时间也不能太长。第四节调查员的选择与培训一、调查员的一般条件诚实与认真调查员必须秉持诚实守信的态度,认真对待每一项调查任务,确保数据的真实性和可靠性。兴趣与能力调查员应对调查工作有浓厚兴趣,并具备相应的专业能力和技能,以胜任复杂的调查工作。勤奋负责调查员应当勤奋工作,对调查结果负责,确保按时高质量完成各项调查任务。谦虚耐心调查员需保持谦虚态度,耐心细致地开展工作,善于倾听和沟通,不断提升自身专业水平。二、调查员的特殊条件调查员的特殊条件1从研究主题考虑调查政治、经济问题以男性调查员为主,婚姻、家庭问题以女性调查员更合适。2从被调查者的特点考虑调查员的年龄、职业、社会地位等背景条件与被调查者越接近越好。3从社区的性质考虑最好选择当地的、同民族、同宗教信仰的调查员。4受教育程度方面受教育程度越高的调查员,理解问题、表达问题的能力越强。三、调查员的培训调查内容与项目介绍(1)研究人员向调查员介绍调查的内容、意义、方法以及与调查项目有关的情况。材料学习与集中培训(2)组织调查员集中学习调查员须知、调查问卷、调查员手册等材料。调查方法专项培训(3)有针对性地对调查员进行调查方法的培训。模拟调查与访问实习(4)进行模拟调查或访问实习,总结经验教训。第五节

调查过程的管理与质量监控调查过程的管理与质量监控包括五个方面:合理组建调查队伍(1)合理组建调查队伍,建立调查小组,指定小组长。建立监督和管理的办法与规定(2)建立监督和管理的办法与规定,包括调查进度控制措施、调查小组管理办法、调查指导和监督措施、资料复核与检查措施、调查小结与交流制度等。实际抽样的管理与监控(3)实际抽样的管理与监控:加强实地指导,在每天的总结会上集中讲解应对方法。实地访问的管理与监控(4)实地访问的管理与监控:研究者深入调查实地,了解和体验实际问题,分别陪同观察每个调查员,每天开会讨论和小结。问卷回收和实地审核的管理与监控(5)问卷回收和实地审核的管理与监控:在调查问卷收回的当天进行审核,研究者随时抽查收回的问卷。第七章

资料处理第一节

原始资料的审核与复查一、资料的审核资料审核是资料处理工作的第一步,是对调查收集到的原始资料进行初步的审查和核实,校正错填、误填的答案,剔除废卷。实地审核一边做调查一边审核资料,优点是及时、效果好,但对调查员要求高。集中审核先将调查资料全部收集回来再集中审核,优点是便于统一安排和管理,审核标准一致,但周期相对拉长,少数个案重新询问较困难。二、资料的复查调查资料收回后的复查机制1在调查资料收回后,由其他人对所调查的样本中的一部分个案进行第二次调查,以检查和核实第一次调查的质量。2基本做法:从原来的调查员调查过的样本中随机抽取5%~10%的个案进行调查。3复查工作对于招聘调查员进行的市场调查必不可少。由其他人对原样本进行第二次独立调查5%~10%复查样本比例第二节

数据编码一、单项选择题的编码1.单项选择题的编码是比较直观的,通常在调查问卷的设计中就已经将答案的代码拟定好了。2.每一道题在数据库里设置一个变量,每个答案被赋予一个阿拉伯数字作为代号,被选择的答案的值就是该题的编码。二、多项选择题的编码1.一个多项选择题在数据库里要转换成多个变量,变量数量由备选答案的数量决定。2.每个备选答案的预编码就是相应变量的代码,被选择的答案编码为“1”,未被选择的答案编码为“0”。三、排序问题的编码排序问题从形式上看和多项选择题有些类似(都是可以选择多个答案),但它的编码与多项选择题则完全不同。虽然问卷里的排序问题也要在数据库里转换成多个变量,但变量的数量不再是由备选答案的数量决定,而是由需要排序的答案的数量来决定;排序问题的代码也不再是备选答案的预编码,而是答案的重要性程度;具体的编码值也不是“1”或“0”,而是所选答案的预编码。四、矩阵式问题的编码1.矩阵式问题在数据库里要转换成多个变量,变量数量由矩阵里的子问题的数量决定。2.变量名称可以用"总问题代码+子问题代码"表示,每个备选答案的代码就是相应变量的编码。3.对于具有定序层次答案的态度问题,编码时要注意方向性。五、编码手册1为了减少编码工作的误差,需要编制编码手册发给编码员。2编码手册将编码的项目和问题一一列出,规定代码、宽度、栏码、简要名称、答案赋值方式及其他特殊规定等。第三节数据录入和清理一、数据录入数据录入方式(1)数据录入方式有直接从问卷上输入数据和先转录到登录表上再输入计算机两种。(2)数据的录入可以采用一般编辑软件,也可以采用专门的数据库管理软件。(3)实际工作中,要挑选和培训数据录入人员,统一规定数据录入格式和数据文件名,严格区分不同录入人员的问卷,最后由研究者将数据合并形成总的数据文件。二、数据清理有效范围清理检查问卷中每个变量的有效编码值范围,找出超出范围的数字并核对纠正。逻辑一致性清理依据问卷中问题相互之间存在的内在逻辑联系,检查前后数据之间的一致性。数据质量抽查从样本的全部个案中抽取一部分个案进行校对工作,用这部分结果估计和评价全部数据的质量。第八章

统计软件应用与统计分析的准备第一节SPSS软件简介一、SPSS的产生与发展SPSS全称"StatisticalPackagefortheSocialSciences",即社会科学统计软件包。应用领域广泛应用于社会科学、商业、医学等领域的统计分析软件,操作简便,能满足非统计专业人士的工作需要。学术认可在国际学术界,凡是用SPSS软件完成的计算和统计方法可以不必说明算法。二、SPSS与其他常用统计软件的比较SAS国际上的标准统计软件和最权威的组合式统计软件,统计功能强大且应用灵活,但对非专业人士学习门槛较高。STATA功能强大,不断集成近年来的新统计方法,运算速度极快,绘图美观,但核心特色是命令操作,对初学者入门难度较高。SPSS最突出的特点是使用Windows窗口方式展示各种管理和分析功能,操作界面友好,输出结果清晰直观,易学易用。三、SPSS的主要应用领域SPSS全球用户规模25万+家产品用户覆盖全球各行业领域,广泛应用于数据分析与统计决策场景主要应用领域农业工业商业医学交通运输公检法社会学市场分析股市行情旅游业四、SPSS的安装、启动与界面安装启动Windows后进入SPSS安装文件所在文件夹,双击SETUP.EXE文件,按提示安装。启动双击桌面快捷方式图标或在【开始】菜单中的【程序】列表里单击相应菜单。界面数据编辑窗口由标题栏、菜单栏、工具栏、数据编辑窗口、状态栏几部分组成。第二节SPSS的数据基本操作一、数据录入1数据编辑窗口数据编辑窗口中,每一行是一个观察个案,每一列是一个变量。2定义变量输入数据的第一步是定义变量,在变量浏览窗口中设置变量名、类型、宽度、小数点位数、变量标签、变量值标签、缺失值等。3数据录入规范实际工作中,要统一规定数据录入格式和数据文件名,不同录入人员的问卷要严格分开,最后由研究者将数据合并。二、数据文件的调用和保存数据文件的调用和保存1直接打开执行【File】/【Open】/【Data】命令,选择文件类型和文件名打开。2用数据库查询方式打开执行【File】/【OpenDatabase】/【NewQuery】命令,可打开dBase文件、Excel文件和Access数据库。3从文本文件导入执行【File】/【ReadTextData】或【File】/【Open】/【Data】选择"*.txt"文件,按向导步骤完成。4数据文件的保存选择【File】/【Saveas】或【File】/【Save】命令保存。三、数据文件的编辑Edit菜单•剪切、复制、粘贴、清除•撤销上次操作和重复上次操作•数据查询(Find)功能Data菜单•InsertVariables(插入变量)•InsertCases(插入记录)•GotoCase(转到记录)四、数据文件的整理SortCases对所有个案按照某个或某几个变量进行排序。Transpose文件转置功能,可将数据文件的行、列进行互换。MergeFiles数据文件合并功能,包括AddCases(合并观测值)和AddVariables(增加变量)。SplitFile数据文件的拆分功能,将数据按某个或某几个变量分成供统计分析用的组。SelectCases从数据文件中选取符合要求的观测量。五、变量的变换和计算Compute:变量计算功能利用原始数据计算特定的数值,形成一个新的变量。通过算术表达式或函数运算,基于现有变量生成派生变量,支持加减乘除、幂运算、对数等常用数学操作。Recode:变量重新赋值功能①RecodeintoSameVariable用新值代替原值②RecodeintoDifferentVariables产生全新变量并保留原变量重新编码功能支持对变量值进行分组、合并、反向计分等操作,适用于数据清洗和变量转换场景。第九章

资料的统计分析(一)——单变量分析第一节

单变量描述统计一、频数表和直方图频数分布与频率表(1)频数分布是一组数据中取不同值的个案的次数分布情况,以频数分布表的形式表达,频率表以百分比形式呈现。(2)频数/频率表对于定类变量和定序变量更为合适,定距/定比数据往往需要人为分组。直方图(3)直方图用矩形面积表示各组频数状况,矩形宽度表示组距,各矩形之间不留空隙。二、集中趋势的度量均值1均值是所有数据累加起来再除以累加数的个数,是使用最为普遍的集中趋势度量。2原始资料直接用简单算术平均数计算,分组资料用加权算术平均数计算。3均值对数据信息的使用相当充分,灵敏度相当高,但受极值影响非常大。中位数1中位数是将所有数据由低至高排列,一分为二,处于正中间的那个值。2原始数据求中位数需先排序,然后找出第(n+1)/2位置所对应的值。3组距分组数据求中位数需要用比例插值法推算近似值。二、集中趋势的度量(三)众数1众数是数据中出现次数最多的数值,不需要计算,只需要看出现次数最多的数值。2组距分组数据求众数需要用比例插值法近似求得。(四)三种集中趋势度量的比较1均值只能用于定距或定比层次数据,中位数可用于定距或定比以及定序层次数据,众数适用范围最广。2在一个对称的正态分布中,均值、中位数、众数是一致的。3数据呈有偏分布时,均值受到极值影响大,中位数稳定得多;多峰分布时报告两个众数更好。三、离散趋势的度量(一)极差和四分位差(1)极差是数据中最大值与最小值之差,方便但不精确,受特异值影响非常大。(2)四分位差是第三四分位数与第一四分位数之间的差值,消除了极差易受极端值影响的特性。(二)标准差(1)标准差是一组数据与其均值之间的平均距离,是使用最频繁的离散趋势度量方法。(2)原始资料计算公式为s=√[∑(X-X̄)²/n],分组资料用加权公式。(3)标准差和均值一样,对特异值的敏感性很强。三、离散趋势的度量(三)方差(1)方差是标准差的平方。(2)在一组数据中方差难以解释,但在推论统计中比标准差更具有理论价值。(四)Z分数Z分数不带有任何单位,使得原来因量纲不一致而不能比较的变量变得可以比较,Z分数表示变量值距离均值有几个标准差。第二节

单变量推论统计一、区间估计区间估计与置信区间1区间估计是指在一定的概率保证下,给出的可能包含总体参数值的一个区间(置信区间)。2置信度反映估计的把握程度,置信区间表明估计的精确性。3常用的置信度分别为95%、99%、99.9%。4总体均值的置信区间:正态总体方差已知用Z分布,方差未知用t分布。5总体成数(百分比)的置信区间公式为[p±Z₁₋α/₂√(p(1-p)/n)]。二、假设检验假设检验的基本思想小概率事件的运用,如果不大可能发生的事件在一次试验中发生了,就有理由认为原假设不正确第I类错误(弃真错误):拒绝了实际上为真的原假设,概率即显著性水平α第Ⅱ类错误(纳伪错误):不拒绝了实际上为假的原假设基本步骤1.提出原假设和对立假设2.确定适当的检验统计量3.给出显著性水平α以及由此得到的临界值4.抽取样本计算检验统计量的值5.做出统计决策大样本检验方法Z总体均值检验大样本状况下Z总体成数检验大样本状况下第三节SPSS基本应用单变量描述性统计Frequencies操作路径(1)单变量描述性统计可通过【Analyze】/【DescriptiveStatistics】/【Frequencies】实现,选择相应的统计量输出。AnalyzeDescriptiveStatisticsFrequenciesZ分数标准化Descriptives操作路径(2)Z分数的标准化可通过【Analyze】/【DescriptiveStatistics】/【Descriptives】,选择"Savestandardizedvaluesasvariables"实现。AnalyzeDescriptiveStatisticsDescriptives"Savestandardizedvaluesasvariables"第十章

资料的统计分析(二)——双变量及多变量分析第一节

变量间的关系一、函数关系与相关关系函数关系与相关关系无绝对界限,可在特定条件下互相转化函数关系当一个变量或几个变量取一定值时,另一个变量有确定的值与之相对应确定性对应相关关系当一个或多个关联变量取定值时,另一变量的取值虽非唯一但遵循某种规律在一定范围内波动统计性关联相互转化函数关系与相关关系之间无绝对界限,可在特定条件下互相转化条件依赖性二、相关关系的分类(1)正相关与负相关正相关是两个变量同向变化,负相关是两个变量反向变化。(2)线性相关与非线性相关线性相关在直角坐标系中近似呈现为一条直线,非线性相关近似为曲线形态。(3)完全相关、不完全相关和完全不相关用[-1,1]区间衡量,0代表完全不相关,±1代表完全相关。(4)单相关、复相关和偏相关单相关涉及两个变量,复相关是一个变量与两个及以上变量相关,偏相关是在控制其他变量下考察两个变量之间的相关性。(5)真实相关和虚假相关真实相关是两个变量确实存在内在联系,虚假相关虽存在数量相关性但无内在逻辑联系。第二节

交互分类一、交互分类的含义交互分类是依据两个或更多变量对一组研究数据进行综合分类,以交互分类表(列联表)的形式展现。(1)交互分类是依据两个或更多变量对一组研究数据进行综合分类,以交互分类表(列联表)的形式展现。(2)条件次数表是不同变量组合下的频数分布,条件百分比表以百分比形式呈现。(3)计算百分比应以自变量为基准,考察在不同自变量条件下因变量的变化情况。二、交互分类表的形式要求交互分类表的形式要求1表格上方明确标注表序和表题。2绘制表格时追求线条简洁。3计算百分比应以自变量为基准。4百分比数值的小数位数根据研究需要合理保留,在同一表格内保持一致。第三节

不同层次变量的相关测量与检验一、相关测量法与消减误差比例(PRE)相关测量法相关测量法是通过统计值(尤其是相关系数)量化变量间相关关系的分析方法。消减误差比例(PRE)消减误差比例(PRE)公式为:PRE=(E₁-E₂)/E₁,表示利用X的值预测Y的值比不利用X的值所能减少的误差占总误差的比例。PRE值越接近1,X与Y的关系越强;PRE=1完全相关,PRE=0完全不相关。二、两个定类变量(或定类与定序)的相关测量与检验Lambda相关测量法通过一个定类变量的值预测另一个定类变量的值,计算能消减多少误差。对称形式λ=[∑mₓ+∑mᵧ-(Mₓ+Mᵧ)]/[2n-(Mₓ+Mᵧ)]不对称形式λᵧ=(∑mᵧ-Mᵧ)/(n-Mᵧ)χ²检验用于交互分类表中变量之间在总体中是否相关的检验。计算公式χ²=∑[(f₀-fₑ)²/fₑ]χ²检验的局限性•卡方值受样本规模影响•显著性水平不能用来判断变量间关系的紧密程度三、两个定序变量的相关测量与检验γ系数适用于对称的两个定序变量之间关系的分析,系数值为-1至+1。G=(Ns-Nd)/(Ns+Nd)检验方法:采用Z检验法(大样本)或t检验法(小样本)。dy系数适用于不对称关系的两个定序变量。dy=(Ns-Nd)/(Ns+Nd+Ty)Ty为同分对数,用于修正不对称关系中的同分情况。四、定类变量与定距变量的相关测量与检验相关比率(E²系数)根据定类变量(自变量)的值来预测和估计定距变量(因变量)的值,范围在0到1之间,具有PRE意义。计算公式E²=[∑niȲi²-nȲ²]/[∑Y²-nȲ²]相关比率的检验F=[E²/(1-E²)]·[(n-k)/(k-1)]采用单因素方差分析的F检验五、两个定距变量的相关测量与检验Pearson相关系数(r)测量两个具有对称关系的定距变量之间的相关强度和方向,取值范围为-1~1。决定系数(r²)具有PRE意义。偏相关系数控制其他要素影响时,单独研究两个要素之间的相互关系,计算公式为rxy·1=(rxy-rx1·ry1)/√[(1-

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论