教育大数据采集与使用中的伦理风险与治理策略研究-结题报告_第1页
教育大数据采集与使用中的伦理风险与治理策略研究-结题报告_第2页
教育大数据采集与使用中的伦理风险与治理策略研究-结题报告_第3页
教育大数据采集与使用中的伦理风险与治理策略研究-结题报告_第4页
教育大数据采集与使用中的伦理风险与治理策略研究-结题报告_第5页
已阅读5页,还剩15页未读, 继续免费阅读

付费下载

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

PAGE 教育大数据采集与使用中的伦理风险与治理策略研究结题报告摘要教育数据的采集规模持续扩大、汇聚程度不断加深,县域教育数据平台日益成为承载学生成长信息的基础设施,数据权属、知情同意、最小必要、二次利用与共享等伦理问题随之显现。本课题以云台市云溪县为研究现场,围绕教育大数据采集与使用的全链条,综合运用文献研究、问卷调查、数据流审计、深度访谈、文本审查与行动研究等方法,回收教师有效问卷298份、学生有效问卷1296份、家长有效问卷861份,访谈师生与管理者132人次,对县域教育数据平台汇聚的46张数据表、1352个字段开展流转链路审计,审查授权文书26份,系统识别了教育大数据在采集与汇聚、存储与留存、使用与调用、共享与流转、销毁与处置各环节中的伦理风险。在此基础上,课题组建构了以数据分类分级、权属约定、知情同意、最小必要、共享与二次利用审批、销毁处置为核心环节的治理机制,研制了《教育大数据最小必要采集清单》《教育数据共享与二次利用审批办法》《教育数据销毁规程》等制度文本,并在8所学校的26个班级开展了为期九个月的实践检验。检验显示,教师数据伦理与治理能力总均值由前测2.68提升至后测3.39,试点学校数据共享申请的审批闭环率达到100%,家长对学生数据使用的知晓率由41.3%提升至92.6%。研究表明,教育大数据的伦理治理应落在机制、制度、能力三个层面,以数据全链条为治理单元,在释放数据价值的同时守住学生及相关主体的权益底线。关键词:教育大数据;数据伦理;数据权属与知情同意;最小必要;二次利用与共享;数据全链条治理一、课题概述(一)研究缘起随着教育数字化转型的推进,教育数据的来源日趋多样,学籍管理、教务安排、作业练习、学业测评、体质健康监测、图书借阅、校园服务、活动参与与家校沟通等系统各自沉淀了数量可观的数据。这些数据在县域层面被逐步汇聚到统一的教育数据平台,形成跨系统、跨学段、跨时段的数据资源池,为学情分析、资源配置与教育决策提供了新的支撑。云溪县教师发展中心在近年来的业务指导中发现,数据汇聚在提升管理效能的同时,也带来了一组此前并不突出的问题:学生和家长往往说不清自己的哪些信息被采集、被谁使用、流向何处;学校在引入数据服务时对数据权属缺乏约定,数据一经汇聚便难以界定归属;部分数据在原始教学目的之外被反复调用,共享与二次利用缺少审批依据;数据一旦进入平台便长期留存,到期处置无从落实。这些问题不同于单一软件的使用风险,而是数据在汇聚、流转与再利用过程中形成的链条性风险,涉及数据的权属、同意、范围、共享与销毁等基本议题。基于上述观察,课题组将教育大数据采集与使用中的伦理风险与治理策略确立为研究课题,力图以数据全链条为分析单元,把风险讲清楚、把制度做出来、把机制试出来。(二)研究任务与完成情况按照开题报告确定的研究设计,本课题共设四项研究任务,至结题时全部完成。第一项任务为教育大数据采集与使用现状及伦理风险的调研诊断,课题组于2027年4月至7月完成8所样本学校的调研,回收三份问卷共2455份有效样本,访谈132人次,并对县域教育数据平台的46张数据表、1352个字段开展流转链路审计,形成《云溪县教育大数据采集与使用现状调研报告》与《教育数据流转链路审计报告》,该项任务已全面完成。第二项任务为伦理风险的类型化分析与风险清单研制,课题组基于调研证据,按数据全链条环节与伦理维度提炼风险条目48条,逐条注明典型表现、危害指向与责任环节,该项任务已全面完成。第三项任务为治理机制与配套制度的设计,课题组形成《教育大数据采集与使用治理机制(试行)》及三项配套制度文本,经专家论证后进入试点,该项任务已全面完成。第四项任务为治理策略的实践检验与修订,课题组于2027年12月至2028年8月在8所学校26个班级开展行动研究,完成两轮迭代修订,前后测数据、机制运行台账与案例集齐备,该项任务已全面完成。总体而言,课题按计划完成了全部研究任务,实现了预期目标。二、研究背景与问题提出(一)政策要求与现实需求从政策层面看,教育数据的规范治理已成为国家制度的明确方向。《中华人民共和国个人信息保护法》确立了处理个人信息应当遵循合法、正当、必要和诚信原则,要求处理目的明确、合理,采取对个人权益影响最小的方式,并规定处理不满十四周岁未成年人个人信息应当取得其父母或者其他监护人的同意,同时赋予个人查阅、复制、更正、删除等权利。《中华人民共和国数据安全法》确立了数据分类分级保护与数据安全审查等基本制度,为数据的汇聚与流转设定了合规框架。《未成年人网络保护条例》要求网络产品和服务提供者严格规范未成年人个人信息的处理活动,对处理的目的、方式与范围作出明确规范。《教育强国建设规划纲要(2024—2035年)》部署实施教育数字化战略行动,在强调以数据赋能教育改革的同时,要求健全与之相适应的治理体系。这些规定共同划定了教育数据处理的法律底线,但多为原则性要求,如何转化为县域教育数据平台与学校层面可执行的环节、标准与流程,仍缺乏成熟的实践方案。从现实需求看,云溪县教育数据的采集与使用呈现出“汇聚快、规范慢”的特征。开题前的初步梳理显示,县域教育数据平台已汇聚来自9类来源系统的数据,涉及数据表46张、字段1352个,其中相当一部分字段是应用系统默认上传而非教学必需;对家长与学生的随机询问表明,多数受访者对学生数据的实际流向缺乏了解;学校在与数据服务方签订的协议中,鲜有关于数据权属、共享范围与处置方式的明确条款。数据一旦汇聚,谁有权调用、在什么目的下调用、调用后如何留痕,均缺乏统一要求,数据在平台内部被反复使用的情形难以追溯。本课题正是在这一背景下提出的,其必要性并不在于否定数据汇聚的价值,而在于为汇聚之后的数据流动建立可依循的规则。(二)拟解决的核心问题本课题拟解决三个核心问题。第一,教育大数据在采集与使用全链条中的伦理风险究竟有哪些具体表现,数据权属、知情同意、最小必要、二次利用与共享四类议题在采集与汇聚、存储与留存、使用与调用、共享与流转、销毁与处置各环节如何显现,其发生机理是什么。第二,针对上述风险,县域与学校层面的治理机制应当包含哪些环节、由谁承担什么责任、依据什么标准运行,如何把法律政策的原则要求转化为可操作的制度安排。第三,治理策略在真实学校与平台情境中能否落地见效,其运行成效如何测量,暴露出哪些需要迭代的问题。三个问题层层递进,构成本课题的研究主线。(三)国内外研究现状围绕教育人工智能与教育数据的风险图谱,已有研究从隐私与数据安全、算法公平与偏见、透明度与可解释性、责任归属等维度建立了较为完整的分析框架,指出教育数据具有敏感性强、涉及未成年人、聚合后重识别风险高等特点。这类成果确立了伦理分析的维度坐标,但其局限在于多以单点应用的数据处理为对象,对多源数据在区域平台汇聚后产生的链条性风险,特别是权属模糊与共享失控等问题的阐释尚不充分。围绕治理框架与制度工具,研究者讨论了知情同意、目的限定、最小必要、存储期限、分类分级与安全审查等制度安排,《中华人民共和国个人信息保护法》《中华人民共和国数据安全法》与《未成年人网络保护条例》为教育场景提供了直接依据,联合国教科文组织《人工智能伦理问题建议书》与OECD《人工智能原则》亦提供了国际参照。但这类研究多以政府部门与数据服务方为治理主体,讨论重心落在宏观制度供给,对县域教育部门与学校在数据全链条中应当承担何种治理角色、依托哪些环节与工具完成治理,缺乏从“最后一公里”出发的操作性设计。围绕教育大数据的专门研究,已有成果较多关注数据驱动的教学改进与区域教育治理,对数据权属的界定、同意机制的有效性、二次利用的边界与共享审批的程序着墨有限,覆盖数据全链条并落脚到可操作制度的系统方案仍不多见。就本课题关切而言,把数据权属、知情同意、最小必要、二次利用与共享四类议题贯通考察,并形成县域可用的机制与制度文本,正是需要填补的空白,也是本课题的定位所在。三、研究目标、内容与方法(一)研究目标本课题的总目标是:摸清教育大数据采集与使用全链条中的伦理风险表现与机理,建构并验证县域与学校层面的治理机制与配套制度,形成可复制、可推广的治理方案,在释放教育数据价值的同时保护学生及相关主体的合法权益。具体目标包括四条:一是完成县域教育数据采集与使用的现状诊断,形成数据资产与流转链路的实证底数;二是阐明数据权属、知情同意、最小必要、二次利用与共享四类风险的生成机理;三是产出治理机制文本与配套制度并完成专家论证;四是通过试点检验治理成效,完成机制修订与成果推广。(二)研究内容第一条内容是教育大数据采集与使用现状及伦理风险的调研诊断。课题组对样本学校的管理者、教师、学生和家长开展问卷调查与深度访谈,同步对县域教育数据平台的数据表与字段进行梳理,开展数据流转链路审计,摸清数据从来源系统到平台汇聚、再到调用与共享的实际路径,识别师生与家长感知的风险点,产出调研报告与数据资产台账。第二条内容是伦理风险的类型化分析。按“环节—表现—伦理维度—危害指向”的框架,围绕采集与汇聚、存储与留存、使用与调用、共享与流转、销毁与处置五个环节,分别分析数据权属不清、同意程序虚化、最小必要失守、二次利用无据与共享失控等风险的表现与机理,形成包含48条风险的风险清单,供县域与学校排查使用。第三条内容是治理机制与配套制度的建构。以“机制—制度—能力”三层落点为纲,设计涵盖数据分类分级、权属约定、知情同意、最小必要、共享与二次利用审批、销毁处置六个环节的治理机制,研制最小必要采集清单、共享与二次利用审批办法、销毁规程等制度文本以及教师数据治理能力培训方案,使制度要求与数据服务的实际流程之间形成可操作的衔接。第四条内容是治理策略的实践检验。通过两轮行动研究验证机制的可行性与成效,测量教师数据伦理与治理能力、学校数据治理运行指标的变化,记录机制运行台账与典型案例,完成机制文本的迭代修订与县域推广。(三)研究方法本研究综合运用六种方法。文献研究法:系统检索并研读2020年以来国内外相关文献150余篇,重点分析政策法律文本与教育数据治理研究,按风险图谱、治理框架、本领域专门研究三条线索形成综述。问卷调查法:编制《教育大数据伦理风险认知问卷》,教师卷设五个维度34题,学生卷设四个维度26题,家长卷设三个维度18题,经预调研60份样本检验信效度后正式施测,回收教师有效问卷298份、学生有效问卷1296份、家长有效问卷861份,使用统计软件完成信度检验、描述统计与差异检验。深度访谈法:按半结构化提纲访谈教师40人、学生52人、学校管理者16人、家长24人,共计132人次,访谈资料逐字转录后按主题编码。数据流审计法:以县域教育数据平台为对象,绘制数据流转链路图,对46张数据表、1352个字段逐一核查采集来源、使用目的与共享去向,标记超出教学必要范围的存疑字段。文本审查法:抽取学校与数据服务方的授权文书、服务协议与同意文本共26份,核查其数据权属、用途、期限、共享范围与撤回条款的完备性。行动研究法:在8所学校26个班级实施治理机制,按“计划—行动—观察—反思”的循环开展两轮迭代,全程留存认知测量、机制运行台账与案例记录。(四)理论依据本课题以四方面理论为支撑。汉斯·约纳斯的责任伦理强调技术时代的前瞻性责任观,主张在数据处理的后果尚不确定时就应承担预防性责任,这为数据最小必要与共享审批的制度设计提供了伦理基础。罗尔斯正义论中的公平原则提示,数据红利的分配不应使处于数据弱势的学生获得更少的发展资源,为审视数据使用中的公平问题提供了分析尺度。信息生命周期理论将数据视为具有采集、存储、使用、流转与销毁等阶段的对象,提示治理必须覆盖数据的输入端与出口端,不能只在采集环节设限,这为本课题以数据全链条为治理单元提供了学理依据。技术接受与治理理论则提示,一项治理制度能否落地取决于执行主体对其感知有用性与感知易用性,这为课题组在两轮行动研究中持续简化流程、控制制度成本提供了依据。此外,贝克的风险社会理论揭示了数据风险的隐蔽性与滞后性,提示治理应具有前瞻性与常态化特征。上述理论共同支撑本课题趋利避害、向善治理的价值取向,也构成了研究设计与分析框架的学理基础。四、研究过程(一)准备与设计阶段(2027年1月—3月)本阶段的核心任务是定方案、建队伍、制工具。2027年1月上旬,课题组召开启动会,对照申报评审书逐条梳理研究任务,形成《课题实施方案》初稿,明确了以教育数据全链条为分析单元、以权属与同意制度设计为落点的研究主线,将研究周期划分为五个阶段,并为每位成员确定责任分工。1月中旬至2月,课题组集中开展文献研读,累计检索并整理国内外相关文献150余篇,重点研读了《中华人民共和国个人信息保护法》《中华人民共和国数据安全法》《未成年人网络保护条例》等政策法律文本中与知情同意、最小必要、分类分级、数据删除相关的条款,形成两万余字的文献摘编,据此搭建“环节—表现—伦理维度—危害指向”的四要素分析框架。2月下旬,课题组着手编制研究工具。问卷方面,编制《教育大数据伦理风险认知问卷》教师卷、学生卷与家长卷;访谈方面,按管理者、教师、学生、家长四类身份分别起草访谈提纲;审计方面,设计《教育数据字段核查表》与《数据流转链路图模板》,用于记录每一类数据的采集来源、使用目的、存储位置与共享去向;同时拟定《授权文书审查清单》,从权属、用途、期限、共享范围、撤回方式五个方面对同意文本进行核查。3月上旬,课题组在本县两所学校选取60名学生和12名教师开展预调研,根据作答分布与反馈意见删除区分度不良的题目5道、合并语义重叠的题目4道,将教师卷确定为五个维度34题、学生卷四个维度26题、家长卷三个维度18题,问卷整体信度系数达到0.88。3月下旬,课题举行开题论证会,专家组肯定了以数据全链条为治理单元的取向,同时提出两条建议:一是数据流审计不能停留在字段数量统计,应把字段与具体的教学目的逐一对应起来,才能使最小必要判断站得住脚;二是制度设计要区分“数据权属”与“数据使用权限”两个不同层次,避免概念混用。课题组据此调整实施方案,把原定笼统的“数据管理规范研究”细化为数据分类分级、权属约定、知情同意、最小必要、共享与二次利用审批、销毁处置六个环节的机制设计任务,并在人员分工上作出相应安排:由负责人统筹全局并主持机制设计,两名成员负责问卷与访谈,两名成员负责数据流审计与字段核查,两名成员负责制度文本起草,一名成员负责台账建设与数据核验。为提升全组对政策的把握能力,课题组在2月至3月组织三次集体学习,逐条研读个人信息保护法律中关于未成年人信息处理、最小必要与删除权的条款,并围绕“汇聚后的数据归谁”“学校有没有权把数据提供给他方”等议题开展两次内部研讨,统一了关键概念的理解。本阶段形成开题报告、实施方案、三套调研工具与两套审计工具共七项阶段成果。(二)现状调研与诊断阶段(2027年4月—7月)本阶段完成了课题全部一手资料的采集与初步诊断。4月至5月,课题组在云溪县第一中学、云溪县第二中学、云溪县第三中学、云溪县育英中学、云溪县实验小学、云溪县育才小学、云溪县城关小学、云溪县新河镇中心小学八所学校开展问卷调查,共发放教师问卷330份、学生问卷1420份、家长问卷960份,回收有效问卷分别为298份、1296份、861份,有效回收率依次为90.3%、91.3%、89.7%。样本构成与数据回收情况见表1。调研对象发放问卷回收有效问卷有效回收率访谈人次教师33029890.3%40学生1420129691.3%52家长96086189.7%24学校管理者———16数据统计显示,78.5%的教师认为数据汇聚明显提高了管理效率,但仅有35.2%的教师表示能够说清本校学生数据的主要去向;43.7%的家长表示从未收到学校或平台关于学生数据使用情况的说明;学生中仅有28.6%知道可以就自己的数据提出查询或删除请求。访谈发现,家长最关心的并非技术原理,而是“数据被谁看到、会不会长期留着”这类朴素问题,而学校对此多以其“平台统一管理”作回应,缺乏向家长清楚说明的依据。6月至7月,课题组完成132人次深度访谈,并对县域教育数据平台开展数据流审计。审计以平台汇聚的46张数据表为对象,逐表核查字段的来源与用途,绘制数据流转链路图18条,标记出超出教学必要范围的存疑字段76个。审计结果按环节汇总见表2。审计环节涉及数据表(张)涉及字段(个)标记存疑字段(个)主要问题类型采集与汇聚46135252来源系统默认上传、超范围采集使用与调用39110414目的漂移、超授权调用共享与流转214867共享范围不清、二次利用无据销毁与处置122683超期留存、无销毁记录合计46135276—审计发现三类值得注意的现象:一是来源系统以“全量上传”为默认设置,采集字段中相当一部分与教学目的没有直接关联,属于技术便利而非教学所需;二是部分数据在原始目的之外被调用,如将活动参与数据用于展示类用途,调用过程无审批记录;三是平台对数据的保存期限未作统一设定,超期留存较为普遍。与之相印证,课题组抽取学校与数据服务方的授权文书、服务协议与同意文本共26份,其中完整载明数据用途、保存期限、共享范围与撤回方式的仅5份,多数文本只作笼统表述,家长难以据此了解数据将被如何使用。本阶段形成《云溪县教育大数据采集与使用现状调研报告》《教育数据流转链路审计报告》两项阶段成果,并建立了包含访谈转录稿、字段核查台账与授权文书扫描件的研究资料库,为后续风险类型化与制度设计提供了完整的一手证据。(三)方案建构/工具开发阶段(2027年8月—11月)本阶段的核心任务是把调研证据转化为治理方案与制度工具。8月至9月,课题组召开三次专题研讨会,对教育大数据的伦理风险进行类型化提炼。提炼按数据全链条的五个环节展开:在采集与汇聚环节,归纳出默认上传、超范围采集、重复采集等表现,主要涉及隐私与数据安全、透明度与可解释性两个维度;在存储与留存环节,归纳出超期留存、存储位置不明、防护措施薄弱等表现,主要涉及隐私与数据安全、责任归属两个维度;在使用与调用环节,归纳出目的漂移、超授权调用、以统计结论替代个体判断等表现,主要涉及算法公平与偏见、责任归属两个维度;在共享与流转环节,归纳出共享范围不清、二次利用无据、跨系统拼接后重识别等表现,主要涉及隐私与数据安全、责任归属两个维度;在销毁与处置环节,归纳出到期不处置、销毁无记录、主体删除请求无响应渠道等表现,主要涉及透明度与可解释性、责任归属两个维度。在此基础上形成《教育大数据伦理风险清单》,共48条,按环节与伦理维度双重归类,风险条目分布见表3。数据环节风险条目数主要涉及伦理维度采集与汇聚12隐私与数据安全、透明度与可解释性存储与留存8隐私与数据安全、责任归属使用与调用12算法公平与偏见、责任归属共享与流转11隐私与数据安全、责任归属销毁与处置5透明度与可解释性、责任归属合计48—按伦理维度归类,48条风险中隐私与数据安全18条、责任归属12条、透明度与可解释性10条、算法公平与偏见8条。每条风险均注明典型表现、危害指向与责任环节,例如“来源系统以全量上传方式默认采集与教学无关字段”“同一批数据在原始目的之外被反复调用而无需审批”“数据保存期限未作设定导致超期留存”“家长无从获知数据流向且缺少查询渠道”等,供县域与学校排查使用。类型化提炼坚持证据支撑原则,每条风险都必须对应到审计台账或访谈记录,无法找到证据的条目一律不予保留。10月上旬,课题组依据“机制—制度—能力”三层落点,起草《教育大数据采集与使用治理机制(试行)》,将治理流程固化为六个环节,各环节的职责、责任主体与记录要求见表4。治理环节主要职责责任主体记录要求数据分类分级对平台数据表逐项分级,标明敏感程度与保护要求县级教育数据管理部门、学校数据专员数据分级台账权属约定明确数据来源方、汇聚方与使用方的权责边界县级教育行政部门、学校数据权属约定书知情同意规范同意文本、取得方式与撤回渠道学校、班主任同意文本与备案记录最小必要依据教学目的核定采集字段,清理冗余字段学校数据专员、学科教研组最小必要采集清单共享与二次利用审批受理共享与二次利用申请,作出审批并附加条件县级教育数据管理部门、学校联席评估审批台账销毁处置到期数据清理、销毁并留痕县级教育数据管理部门、学校数据专员销毁记录10月下旬至11月,课题组配套研制三项制度文本。《教育大数据最小必要采集清单》以教学目的为基准,把字段划分为教学必需、教学相关但须限权、与教学无关应当禁止三类,为学校与数据服务方的约定提供依据;《教育数据共享与二次利用审批办法》规定了申请的发起主体、审批层级、办理时限与附加条件,并要求对每一次调用留痕;《教育数据销毁规程》明确了各类数据的保存期限、到期提醒机制、销毁方式与双人核验要求,同时为学生及家长提出查询、更正、删除请求提供了受理渠道。同步开发的教师数据治理能力培训方案包含数据权益认知、最小必要判断、共享审批操作三个模块共八学时,配套12个教学与数据情境案例。方案建构过程中遇到的主要问题是制度文本与数据服务实际流程的衔接。初稿把共享审批设计为单一部门受理,试点学校与平台方反馈审批环节与技术调用流程脱节,容易出现“先调用、后补批”。课题组经与八校管理者及平台技术人员座谈,将共享审批前置嵌入数据服务协议,把审批结论作为数据接口开放的前提条件,既保证了把关功能又降低了流程返工。11月下旬,课题组召开专家论证会,邀请县教育科学研究所教研员与高校专家对机制文本进行论证,专家组提出将敏感程度判定作出可操作的情形说明、将销毁核验明确为双人签字等六条修改意见,课题组逐条采纳修订。本阶段形成风险清单、治理机制文本和三项配套制度共五项阶段成果。(四)实践检验阶段(2027年12月—2028年8月)本阶段在8所学校26个试点班级开展行动研究,覆盖学生1100名、教师88名,按两轮迭代推进。第一轮自2027年12月至2028年4月。启动前,课题组对全体试点教师进行数据伦理与治理能力前测,总均值为2.68;对试点班级的家长开展数据使用知晓情况调查,知晓率为41.3%。随后组织教师培训四场次,解读治理机制与三项制度,并完成试点范围的数据分类分级,46张数据表全部标明敏感程度与保护要求。试点运行中,各校按最小必要清单清理了冗余采集字段63个,将同意文本统一改版并覆盖试点学生家庭,共享与二次利用一律先行审批,销毁规程将超期留存数据的清理纳入常规工作。第一轮结束时共受理数据共享申请28件,经审批同意19件,其中4件附加了最小必要限制条件;按销毁规程清理超期留存数据11批次。中期评估发现三个突出问题:一是分类分级标准在“敏感程度”的判断上口径不一,不同学校对同一类数据的定级存在差异;二是共享审批虽已建立,但与学校既有的数据服务采购流程仍有脱节,个别调用存在补办审批的情况;三是销毁规程缺少技术核验环节,销毁结果的可靠性难以确认。课题组于2028年5月召开反思会,对机制作出三项调整:编制敏感程度判定指引,把抽象分级转化为可对照的情形描述;将共享审批前置嵌入数据服务协议的签订环节,未经审批不得开放数据接口;在销毁规程中增设技术核验环节,要求销毁处理由两人共同确认并留存记录。第二轮自2028年5月至8月。调整后的机制运行明显顺畅,第二轮受理数据共享申请19件,经审批同意15件,其中2件附加限制条件;销毁技术核验完成率由第一轮的81.8%提升至96.3%。第二轮同步对试点学生与家长开展后测与抽样访谈,共访谈学生30人、教师22人、家长18人,多数受访家长表示“现在知道孩子的数据用在什么地方了”,多位教师反映最小必要清单使自己在上报数据时更有意识地考虑“这些字段是否真的需要”。8月下旬,课题组完成教师后测,总均值提升至3.39,并系统整理两轮运行台账与典型案例。本阶段形成试点运行报告、案例集和教师培训方案三项阶段成果。(五)总结提炼阶段(2028年9月—12月)本阶段的任务是数据整理、成果提炼与推广辐射。9月,课题组对全部研究数据进行归档与二次核查,重点比对前后测数据、共享审批台账、字段清理记录与销毁记录的一致性,邀请县教育科学研究所人员对数据链条进行核验,确认各类数据表数量、字段数与统计口径前后一致。10月,课题组召开成果提炼研讨会,将两年研究凝练为“四类议题、五个环节、六项制度”的治理框架:四类议题即数据权属、知情同意、最小必要、二次利用与共享;五个环节即采集与汇聚、存储与留存、使用与调用、共享与流转、销毁与处置;六项制度即分类分级、权属约定、知情同意、最小必要、共享审批、销毁处置。在此基础上完成结题报告初稿和三篇研究论文的撰写。11月,课题组先后在八所试点学校及周边学校举办治理机制推广培训8场次,覆盖县域教师520人次,向县教育行政部门提交《关于加强县域教育数据采集与使用治理的建议》决策咨询报告。12月上旬,根据推广培训中收集的34条反馈意见,课题组对机制文本进行最后一轮微修,重点补充了数据服务方更换时的数据迁移与清除条款;中旬完成结题报告定稿与全部附件的规范化整理,课题研究按计划收官。整个总结提炼阶段,课题组坚持数据可追溯原则,对每一项结论都保留原始记录支撑,将前后测原始数据、字段核查台账、审批台账、销毁记录与案例素材按类别装订成册,形成完整的课题档案,既保证了结题材料内部的相互印证,也为后续研究提供了可复核的资料基础。五、研究成果(一)认识性成果第一,教育大数据的伦理风险具有鲜明的链条性,治理必须以数据全链条而非单点应用为单元。研究发现,教育数据的风险很少孤立地发生在采集环节,而是在汇聚、调用、共享与留存的连续流动中逐级放大:一次超出教学必要的采集,可能因后续的重复调用与跨系统共享而被放大为难以追溯的风险;一处未约定的数据权属,可能在平台更换与数据迁移时演变为处置争议。抽象层面的伦理原则若不落到数据流动的具体环节,就无法转化为学校与平台可执行的规则。这一认识解释了为什么仅在采集端设限难以奏效,也确立了本课题以“采集与汇聚—存储与留存—使用与调用—共享与流转—销毁与处置”五环节为治理单元的基本立场。进一步说,链条化治理并不排斥统一原则,而是要求把统一原则分解为环节化的判断标准,例如最小必要原则在采集环节落实为字段与教学目的的逐一对应,在共享环节落实为调用目的的逐次审批。第二,数据权属的模糊是链条风险的源头,权属约定是治理的前提性制度。调研与审计显示,多数学校在与数据服务方的关系中并未明确数据归谁所有、谁有权调用、谁能对外提供,学校往往以为“数据在平台就是平台的”,而平台方则默认“数据由学校提供、由学校负责”,双方在权责上相互悬置。这种悬置状态使风险在出现时找不到归属,也使治理缺乏明确的责任起点。由此可以得出一个治理判断:权属约定必须先于功能开发与数据共享,只有把来源方、汇聚方与使用方的权责边界明确下来,后续的分类分级、共享审批与销毁处置才有可依循的归属。换言之,权属不是数据的附属问题,而是整个治理链条的起点。第三,知情同意与最小必要是相互支撑的一组约束,前者解决“能不能采”,后者解决“该采多少”。研究发现,单纯加强同意程序并不足以缩小数据采集范围,因为同意文本即便形式完备,若采集字段本身超出教学必要,家长的“同意”也难言实质;反之,单纯强调最小必要而不改善同意机制,家长仍无法了解哪些必要数据被采集、将用于何处。两者必须叠加使用:最小必要划出采集的上限,知情同意保障主体的知情与选择,共同把数据采集约束在合理的范围内。这一认识提示,治理工具应当成组设计,把同意机制与最小必要清单配套使用,才能避免形式化的合规。(二)操作性成果本课题产出四项可直接使用的操作性成果,其构成与使用方式见表5。成果名称形式构成要素使用方式教育大数据伦理风险清单风险清单五个环节48条风险条目,按环节与伦理维度双重归类,注明典型表现、危害指向与责任环节供县域与学校排查数据风险对照使用教育大数据采集与使用治理机制(试行)机制文本数据分类分级、权属约定、知情同意、最小必要、共享与二次利用审批、销毁处置六个环节及职责与记录要求由县级教育数据管理部门与学校数据专员组织实施最小必要采集清单及配套制度汇编制度汇编最小必要采集清单、共享与二次利用审批办法、销毁规程、同意文本模板纳入学校数据管理与数据服务协议签订流程教师数据治理能力培训方案培训方案数据权益认知、最小必要判断、共享审批操作三个模块八学时课程包,配套12个情境案例以校本研修与县域培训形式面向教师实施风险清单将48条风险按环节分组编码,每条附排查要点与对应责任环节,试点学校据此在数据服务审议环节平均每项服务提出整改问询4项。治理机制文本明确了每个环节的责任主体与记录要求,其中共享与二次利用审批环节规定五个工作日内答复、并须说明审批理由与附加条件,为数据的对外提供提供了闭环路径;销毁处置环节规定了保存期限、到期提醒与双人核验要求,弥补了以往“只进不出”的管理空白。最小必要采集清单以教学目的为基准逐项划定字段类别,并与同意文本模板配套使用,试点期间成为学校签订数据服务协议时的常规对照工具。培训方案包含案例研讨、情景演练与制度测试三种形式,参训教师可据此完成从认识到操作的转化。(三)实践成效总述从总体上看,本课题在实践层面取得了三方面成效:其一,试点学校的数据管理从“汇聚即用”转向“依规流动”,46张数据表全部完成分类分级,采集字段按最小必要清单清理,数据调用须以审批为前提;其二,数据共享与二次利用从“无据调用”转向“审批留痕”,试点期间累计受理共享申请47件,经审批同意34件,全部形成可追溯的台账;其三,师生的数据权利意识从“无从知情”转向“有渠道可及”,家长对学生数据使用的知晓率明显提升,学生及家长可就数据提出查询、更正与删除请求并得到受理。上述三方面成效共同表明,县域与学校层面的治理机制能够在不否定数据价值的前提下,有效约束教育大数据采集与使用中的伦理风险。(四)成果的应用与推广课题成果的推广分三个层次展开。在学校层面,八所试点学校已将治理机制纳入学校数据管理常规,自2028年秋季学期起明确了数据专员在分类分级、最小必要把关与销毁核验中的职责。在县域层面,课题组于2028年11月举办推广培训8场次,覆盖八所试点学校及周边学校教师520人次,县教育科学研究所将《教育大数据最小必要采集清单》转发至全县中小学参考使用,多所学校结合自身实际进行了校本化改编。在成果辐射层面,课题组向县教育行政部门提交决策咨询报告一份,三篇研究论文中已有一篇公开发表、两篇通过期刊初审。推广培训中收集的教师反馈显示,认为治理机制“明确有用”的占87.6%,反映“与既有工作流程存在衔接成本”的占25.4%,后者提示制度嵌入流程的方式仍需在更大范围内持续优化。总体来看,课题成果初步实现了从校本经验向县域公共产品的转化。六、研究成效分析(一)教师数据伦理与治理能力的变化教师是本课题治理策略的直接作用对象,其变化通过前后测问卷、执行台账与访谈三角验证。前后测采用同一份《教师数据伦理与治理能力问卷》,五个维度各6题,以5点量表计分。88名试点教师前测总均值为2.68,后测总均值为3.39,提升0.71,配对样本检验达到显著水平,效应量为0.85,属于较大幅度的实质性提升。各维度得分见表6。维度前测均值后测均值提升幅度效应量数据权属与责任认知2.723.410.690.82知情同意运用2.653.350.700.84最小必要把关2.773.480.710.86共享与二次利用审查2.583.280.700.83全链条制度运用2.693.430.740.88总均值2.683.390.710.85从各维度的提升幅度看,全链条制度运用维度的改善最为明显,提升0.74,说明机制文本与配套制度这一工具对教师重新认识数据流动的全过程最具直接作用;最小必要把关与知情同意运用维度提升0.70至0.71,共享与二次利用审查维度虽提升幅度居中,但因前测基数最低,其相对改善幅度最大。从过程性指标看,教师的行为改变同样清晰:试点学校上报数据时对照最小必要清单的比例由第一轮的74%提升至第二轮的95%;共享审批前置后,未经审批调用数据的现象基本消除。访谈中,多位教师表示培训中“数据流向复盘”环节对其触动最大,使其意识到“一个字段被采集之后会走多远”。教师韩老师在访谈中谈到,过去汇总学生信息时习惯“能填就填”,如今会先核对最小必要清单,“可填可不填的就不再填了”,这一细节折射出教师从数据执行者向数据把关者的角色转变。分群体比较还发现,兼任信息管理工作的教师在后测中的共享与二次利用审查维度得分高于普通教师,差距约0.26,原因在于前者更熟悉数据流转的实际路径;而青年教师在数据权属与责任认知维度上的提升幅度更大,说明培训与制度工具对两类教师群体的作用点有所不同,后续推广时应分类安排支持策略。(二)学校数据治理运行层面的变化学校层面的成效体现为治理机制的建设与运行。八所试点学校均明确了数据专员并完成机制文本的校本转化,试点期间围绕数据表的分类分级、字段清理、共享审批与到期销毁形成了完整台账,机制运行的核心数据见表7。运行指标第一轮(2027.12—2028.4)第二轮(2028.5—8)合计完成分类分级数据表(张)46—46受理数据共享申请(件)281947审批同意(件)191534其中附加最小必要限制条件(件)426清理冗余采集字段(个)63—63清理超期留存数据批次(批)11819销毁技术核验完成率81.8%96.3%—从闭环情况看,47件共享申请全部作出审批结论,无一件积压,审批闭环率达到100%;34件获准共享的申请中6件附加了最小必要限制条件,其余均明确了使用目的与保存期限。字段清理方面,审计标记的76个存疑字段经逐项核实后,确认冗余字段63个并予清除,其余13个因确有教学必需予以保留并补列入最小必要清单,清理后平台的必要采集字段为1289个。销毁方面,两轮累计清理超期留存数据19批次,第二轮通过增设技术核验环节使销毁结果的可靠性明显提高。机制运行还带来管理观念的转变:过去学校对数据服务多持“开通即用”的态度,如今将分类分级、权属约定、共享审批、到期销毁纳入常规管理,管理链条由单点开通扩展为全过程留痕。制度落地还改善了家校信息不对称状况,试点学校在首次备案时向家长发放数据使用说明并统一改版同意文本,家长对学生数据使用的知晓率由试点前的41.3%上升至试点后的92.6%,家长反映“知道孩子的数据被用在什么地方、会保留多久”。八所试点学校在机制运行中逐步积累了本地数据资产台账与共享审批记录,为后续数据服务的续用、更换与退出判断提供了依据。从治理成本看,试点后期每校每月的制度性工作量已由启动阶段的约三小时压缩至一小时以内,说明机制经过迭代可以逐步内化为常规管理的一部分,而非长期额外负担。县教育科学研究所的核验意见认为,试点学校初步形成了“进有分级、用有审批、享有限制、销有核验”的数据治理链条,为县域层面制定统一的数据管理要求提供了实践样本。(三)区域层面的变化区域层面的变化主要体现为县域教育数据管理制度的健全与数据治理力量的成长。在制度层面,县教育行政部门参考课题成果,将数据分类分级、最小必要与共享审批的基本要求纳入县域教育数据管理要求,明确了数据调用须以审批留痕为前置条件,改变了过去数据汇聚后“谁都能看、谁都能用”的松散状况。在力量层面,八所试点学校各明确了至少一名数据专员,课题组为其编制了工作手册并开展专题培训,初步形成了一支覆盖试点学校的数据治理骨干队伍,能够独立完成分类分级与审批台账的维护。在文化层面,通过推广培训与家校沟通,数据权益意识在教师和家长中得到扩散,试点学校受理并办结的学生及家长数据查询、更正与删除请求合计37件,全部在规定时限内答复,其中删除请求9件均已依规办理并留存记录。推广培训中,多所非试点学校主动索取最小必要采集清单与同意文本模板,反映出制度工具在县域范围内具有一定的自扩散效应。区域层面的这些变化表明,课题成果不仅解决了试点学校的具体问题,也在县域范围产生了制度供给与能力建设的双重效果。(四)典型案例案例一:一份被反复调用的活动数据。初三学生小舟在某学期参与了一次校级展示类活动,其活动参与记录与相关展示信息被用于一次校内展示。活动结束后,小舟的家长刘女士在查看学校发放的数据使用说明时产生疑问:孩子的活动数据为何会被用于展示,学校是否事先征求过同意。她通过学校公布的数据权益渠道向学校数据专员提出查询。数据专员依据《教育数据共享与二次利用审批办法》调取台账,核查后发现该次使用属于在原始目的之外调用数据,未履行二次利用审批,属目的漂移类风险。学校随即向刘女士说明情况并致歉,补办了数据使用的审批手续,明确该批数据仅用于校内展示、不得对外提供,同时将展示材料中涉及小舟的个人信息予以调整。刘女士对处理结果表示认可,撤回了异议。此事的直接变化是,学校将数据二次利用审批前置嵌入各类活动方案报批流程,凡涉及调用已有数据的活动,须先完成审批再行实施;随后两个月内,学校又依此流程审核活动数据使用申请6项,其中2项因目的不清被要求修改方案后重新申报。刘女士在反馈中说,让她放心的不是某一次纠错,而是“有一个能问得清、答得上来的地方”。学校在案例记录中反思,若没有台账与审批制度,这次调用很可能因为无人留痕而“说不清”,家长的疑问也将无从回应;数据治理的价值,有时恰恰体现在让每一次使用都“说得清”。案例二:一名学生提出的删除请求。六年级学生小桐在低年级阶段使用过一系列练习与测评,升入高年级后,其家长在一次家校沟通中得知平台仍留存着孩子早期的练习记录与测评结果,遂提出删除请求。学校数据专员按《教育数据销毁规程》受理了请求,先核对该批数据的保存期限与使用状态:经查,相关练习数据已超出约定的保存期限,属超期留存,应予清理;测评结果因仍在学业成长记录的必要保存期内,按规定予以保留并向家长说明理由。经与小桐家长确认后,学校对该批超期练习数据实施清理,销毁处理由数据专员与教务人员两人共同确认,填写销毁记录并留存备查。整个过程历时四个工作日,家长在办理回执上签字确认。此后,小桐家长主动向其他家长介绍学校的数据权益渠道,该班又有两名家长提出了数据查询请求并得到答复。学校在案例反思中写道,学生与家长的数据权利若要真正可及,不能只靠原则宣示,必须有明确的受理渠道、可核查的保存期限与可追溯的处置记录;销毁规程的意义不仅在于清理数据本身,更在于让主体看到自己的请求被认真对待。该案例被收入案例集,在县域推广培训中作为销毁与处置环节的演示案例使用。值得注意的是,数据请求的提出与办理并非一蹴而就,其间涉及数据是否属必要保存范围的专业判断,这说明数据治理既需要有温度的回应,也需要有依据的裁量。七、研究反思与后续研究方向(一)研究的主要局限本课题的局限首先来自样本范围。调研与试点均在云台市云溪县八所学校内完成,26个试点班级的规模虽能满足行动研究的基本要求,但县域学校的平台条件、数据管理与人员配置同大城市学校存在差异,治理机制在不同办学条件学校间的适用性尚未得到充分检验。其次是审计口径的约束。数据流审计以县域教育数据平台的46张数据表、1352个字段为对象,对字段必要性的判断依赖课题组与学校、平台技术人员的共同商议,带有一定的专业裁量成分,不同判断者对于“教学必需”的界定可能存在出入。再次是研究周期的限制。数据的伦理风险具有滞后显现的特点,超范围采集在短期内未必造成可感知的损害,数据拼接后的重识别风险往往在多方数据联动之后才逐步显露,这些长周期效应在两年研究窗口内只能看到初步迹象。最后,技术迭代速度快于研究进程,研究期间数据来源系统的字段设置与接口方式经历了多次调整,部分针对旧版本设计的治理条款在结题时已需要更新表述,成果的时效性面临持续压力。此外,课题组成员本身既是治理机制的设计者又是执行者,双重身份虽有助于获取一手资料,但也可能使研究者在评价机制成效时存在一定的自我确认倾向,课题组通过引入外部专家论证、县教育科学研究所数据核验等方式尽量降低了这一影响。(二)尚未解决的问题有三类问题在课题周期内未能彻底解决。一是数据权属的统一界定仍显不足,本课题在县域与学校层面确立了权属约定的框架,但对数据在区域平台与数据服务方之间究竟如何划分所有权与使用权,尚缺乏更高层面的制度依据,学校层面的约定只能部分化解权责悬置。二是跨部门数据共享的边界仍不清晰,教育数据与卫生健康、民政等领域数据一旦联动,其必要

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论