2026年健康大数据管理师医疗卫生职业试题及答案_第1页
2026年健康大数据管理师医疗卫生职业试题及答案_第2页
2026年健康大数据管理师医疗卫生职业试题及答案_第3页
2026年健康大数据管理师医疗卫生职业试题及答案_第4页
2026年健康大数据管理师医疗卫生职业试题及答案_第5页
已阅读5页,还剩10页未读 继续免费阅读

付费下载

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

2026年健康大数据管理师医疗卫生职业试题及答案一、单项选择题(每题1分,共30分)1.健康大数据的“5V”特征中,下列哪项描述通常是错误的?A.Volume(规模大)B.Velocity(产生快)C.Variety(类型多)D.价值密度高答案D解析健康大数据价值密度低,需要通过大量数据挖掘才能获得有价值信息。2.电子健康档案的英文缩写是:A.EMRB.EHRC.HISD.PHR答案B3.根据我国《个人信息保护法》,健康医疗信息属于:A.一般个人信息B.敏感个人信息C.匿名信息D.公共信息答案B4.处理敏感个人信息应当取得个人的:A.默示同意B.口头同意C.单独同意D.无需同意答案C5.医学影像数据通常采用的国际标准是:A.HL7B.DICOMC.LOINCD.ICD-10答案B6.疾病分类与编码最常用的国际标准是:A.SNOMEDCTB.LOINCC.ICD-10D.DICOM答案C7.ROC曲线下面积AUC等于0.5时,通常表示该模型:A.完美分类B.性能极差C.与随机猜测相当D.存在严重偏倚答案C8.队列研究中,相对危险度RR的计算方法是:A.暴露组发病率减非暴露组发病率B.暴露组发病率除非暴露组发病率C.暴露组患病率除非暴露组患病率D.两组发病人数之比答案B9.数据清洗中处理缺失值最合理的做法是:A.一律删除记录B.一律用0填充C.根据业务规则和数据分布选择合适的填补策略D.对缺失值不作任何处理答案C10.以下哪项属于非结构化健康数据?A.患者姓名B.医师书写的病程记录C.诊断ICD编码D.检验数值答案B11.根据《医疗机构病历管理规定》,住院病历由医疗机构保管的时间原则上不少于:A.10年B.15年C.20年D.30年答案D12.下列哪项不属于医疗健康数据脱敏的常用方法?A.数据替换B.数据遮蔽C.数据泛化D.将明文数据无保护地上传到公共网盘答案D13.数据仓库区别于传统事务数据库的核心特征是:A.面向主题、集成、时变、非易失B.面向事务、实时更新C.仅存储结构化数据D.不允许保存历史数据答案A14.在数据分析建模中,过拟合的典型表现是:A.训练误差和测试误差均低B.训练误差低、测试误差高C.训练误差高、测试误差低D.训练误差与测试误差均高答案B15.健康大数据分析中,K-means算法属于:A.分类算法B.聚类算法C.回归算法D.规则提取算法答案B16.医疗信息交换标准HL7主要用于:A.医学影像存储B.实验室检验结果编码C.医院各系统间消息交换D.疾病分类统计答案C17.关于匿名化与去标识化的区别,下列说法正确的是:A.匿名化后数据仍可结合其他信息识别个人B.去标识化就是匿名化C.匿名化处理后无法识别且不能复原特定个人D.二者完全等同答案C18.数据质量评价中,“完整性”是指:A.数据值符合业务规则B.记录和字段无缺失、覆盖充分C.数据在多个系统间一致D.数据更新及时答案B19.可穿戴设备产生的连续心率数据主要体现大数据的哪个特征?A.VolumeB.VelocityC.VarietyD.Veracity答案B20.健康医疗数据治理中,“数据元”指的是:A.数据库表B.不可再分的最小数据单元C.数据分析模型D.数据展示图表答案B21.进行多家医院数据整合分析前,最关键的第一步是:A.直接合并所有字段B.统一数据标准与术语编码C.删除所有缺失记录D.上传至公共云端答案B22.电子数据采集系统(EDC)在临床试验中的主要作用是:A.代替伦理审查B.采集和管理临床试验数据C.自动生成诊断报告D.对患者进行治疗答案B23.以下哪项不属于健康医疗大数据的常见来源?A.医院信息系统B.医保结算数据C.可穿戴健康设备D.天气观测站实时温度数据答案D24.隐私保护计算技术中,允许各方在不共享原始数据的前提下共同训练模型的是:A.联邦学习B.明文数据传输C.中心化数据湖D.将数据复制给所有参与方答案A25.数据可视化中,展示各类别构成比最合适的图表是:A.折线图B.饼图或环形图C.散点图D.热力图答案B26.“FAIR”数据原则不包括:A.可发现B.可获取C.可互操作D.可盈利答案D27.关于敏感个人信息处理,下列说法错误的是:A.应具有特定目的和充分必要性B.应取得个人单独同意C.可以不采取任何安全措施D.应向个人告知处理目的和方式答案C28.在健康大数据分析中,能够提示模型区分患病与未患病能力强弱的指标是:A.AUCB.样本量C.运行时间D.变量数量答案A29.医疗保险数据用于健康状况分析时,常见的主要偏倚是:A.选择偏倚,因参保人群与全人群差异造成B.天气偏倚C.仪器偏倚D.回忆偏倚答案A30.对电子病历文本进行结构化处理常用的技术是:A.自然语言处理(NLP)B.仅用Excel排序C.人工重新抄录D.删除非结构化文本答案A二、多项选择题(每题2分,共20分)1.健康医疗大数据主要来源包括:A.电子健康档案B.可穿戴设备C.医保结算数据D.基因测序数据E.非医疗类购物记录答案ABCD2.数据质量评价的常用维度包括:A.准确性B.完整性C.一致性D.及时性E.隐私性答案ABCD解析隐私性属于数据安全保护范畴,一般不作为数据质量评价维度。3.以下哪些技术可用于降低健康数据被重识别的风险?A.删除直接标识符B.对出生日期等准标识符进行泛化C.添加随机噪声D.差分隐私E.将数据无加密发布到互联网答案ABCD4.医疗数据安全保护措施包括:A.基于角色的访问控制B.传输和存储加密C.审计日志D.数据脱敏E.对废弃介质进行物理销毁答案ABCDE5.健康大数据分析中常用的有监督学习算法包括:A.逻辑回归B.决策树C.随机森林D.支持向量机E.K-means答案ABCD解析K-means属于无监督聚类算法。6.影响统计分析结果可靠性的偏倚主要有:A.选择偏倚B.信息偏倚C.混杂偏倚D.发表偏倚E.偶然误差答案ABCD7.电子健康档案的核心内容通常包括:A.个人基本信息B.病历摘要C.检查检验结果D.预防接种记录E.非医疗类消费流水答案ABCD8.健康数据跨机构共享应遵循的原则有:A.目的限定B.最小必要C.安全保护D.责任明确E.随意删除审计记录答案ABCD9.数据生命周期管理通常包括:A.采集B.存储C.处理与分析D.共享与使用E.销毁答案ABCDE10.下列属于准标识符的是:A.出生日期B.性别C.邮政编码D.民族E.身份证号答案ABCD解析身份证号属于直接标识符,不属于准标识符。三、判断题(每题1分,共20分)1.健康大数据具有“价值密度高”的特点。答案错误2.电子健康档案全部由结构化数据组成。答案错误3.《个人信息保护法》将健康医疗信息列为敏感个人信息。答案正确4.处理敏感个人信息需要取得个人的单独同意。答案正确5.匿名化处理后的数据在法律上不再属于个人信息。答案正确6.数据清洗中,对于重复记录可以不经核查直接合并。答案错误7.联邦学习允许参与机构在不共享原始数据的情况下协同建模。答案正确8.数据脱敏后可以完全恢复为原始数据。答案错误9.ROC曲线越靠近左上角,模型分类性能越好。答案正确10.ICD-11是疾病分类编码标准。答案正确11.健康大数据不包括基因组数据。答案错误12.数据可视化中,折线图适合展示时间趋势。答案正确13.数据仓库以面向事务的实时写入为主。答案错误14.知情同意是收集个人健康数据的伦理前提之一。答案正确15.数据质量中的“一致性”指同一数据在不同系统中取值是否一致。答案正确16.患病率是指某时期内新发病例占暴露人口的比例。答案错误17.使用医疗健康数据时,遵循“最小必要”原则有助于降低隐私风险。答案正确18.数据加密可以替代所有其他访问控制措施。答案错误19.数据共享后,数据接收方可以不受原协议限制任意向第三方提供。答案错误20.在健康大数据分析中,样本量越大就一定意味着结论越可靠。答案错误四、简答题(每题5分,共15分)1.简述健康医疗大数据的5V特征及其对数据分析的主要挑战。答案5V特征包括Volume(规模大)、Velocity(产生快)、Variety(类型多)、Veracity(真实性/质量参差)、Value(价值密度低)。主要挑战:海量数据存储与算力要求高;实时处理难度大;多源异构数据整合复杂;数据质量管理困难;需要采用大数据分析和人工智能等方法从低价值密度数据中提取高价值信息。2.简述数据去标识化与匿名化的区别。答案去标识化是指去除或替换姓名、身份证号等直接标识符,但可能保留出生日期、性别、住址等准标识符,结合其他信息仍可能识别个人,处理后数据通常仍属于个人信息。匿名化是指经过处理使数据无法识别特定自然人且不能复原,处理后数据不再属于个人信息。匿名化要求不可逆,而部分去标识化方法如假名化仍可能通过额外信息恢复。3.简述健康大数据分析中防范数据泄露的常见技术与管理措施。答案技术措施包括:基于角色的访问控制、数据加密存储与传输、数据脱敏、使用联邦学习和差分隐私等隐私保护计算技术、审计日志、备份与恢复。管理措施包括:遵循目的限定和最小必要原则、签署保密协议、人员权限分级、定期安全培训、制定数据安全应急预案、开展合规审查。五、案例分析题(共15分)某市卫生健康委员会计划整合8家医疗机构近5年门诊和住院数据,用于慢性病发病趋势分析。原始数据包含姓名、身份证号、住址、手机号、出生日期、性别、诊断ICD编码、检验结果、收费明细等,累计涉及200万患者。现拟将数据共享给第三方数据分析公司。问题:1.指出数据中的直接标识符和准标识符,各至少列出3项。2.说明数据采集与共享前应满足哪些法律和伦理要求。3.提出至少4项降低重识别风险的技术措施。4.简述为保障数据安全应建立的数据治理机制。答案:1.直接标识符:姓名、身份证号、手机号。准标识符:出生日期、性别、住址或邮政编码。2.法律和伦理要求:处理健康医疗信息等敏感个人信息需取得个人单独同意或符合法律规定的例外情形;处理应具有明确、特定的目的,并遵循最小必要原则;共享数据不能超出约定目的;应与第三方签订数据处理协议,明确安全责任;应向个人告知处理目的、方式和范围;开展个人信息保护影响评估。伦理方面:涉及人的数据研究应进行伦理审查;应获取知情同意或符合伦理豁免条件;开展风险收益评估,保护受试者权益。3.降低重识别风险的

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论