高中二年级信息技术选择性必修4“回归算法”教学设计_第1页
高中二年级信息技术选择性必修4“回归算法”教学设计_第2页
高中二年级信息技术选择性必修4“回归算法”教学设计_第3页
高中二年级信息技术选择性必修4“回归算法”教学设计_第4页
高中二年级信息技术选择性必修4“回归算法”教学设计_第5页
已阅读5页,还剩6页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

高中二年级信息技术选择性必修4“回归算法”教学设计一、教学指导思想与理论依据本课依据《普通高中信息技术课程标准(2017年版2020年修订)》对选择性必修模块"人工智能初步"的要求,聚焦"通过剖析典型智能系统的实现过程,了解智能信息处理的巨大进步和应用潜力,认识人工智能在信息社会中的重要作用"这一核心目标。课标指出,教学中应引导学生经历从数据采集、模型构建到结果评估的完整过程,发展计算思维与信息素养。回归算法是机器学习中最基础、最直观的任务类型之一,任教班级此前已在选择性必修3中学习过数据采集与简单分析,具备Python基础语法能力。本课以"预测"这一学生熟悉的生活经验为切口,把抽象的数学原理降维为可观察、可操作、可验证的学习任务,让学生在"做中学"中建立对监督学习的初步认知框架,为后续分类算法、神经网络等内容奠定方法论基础。二、教材分析本节是第二单元"判别事物"之后的内容,处于从"规则判断"走向"数据驱动决策"的关键过渡位置。教材以房屋面积与房价的关系为例,引出线性回归的基本思想,涉及散点图观察、拟合直线、最小二乘思想、模型评估等核心概念。本节内容的特点有三。其一,数学味浓。回归系数、残差、均方误差等概念与数学必修、选择性必修中的统计知识相互呼应,是学科融合的天然载体。其二,实践性强。Python的numpy、matplotlib、scikitlearn等库为动手实验提供了低门槛工具,教学过程完全可以设计成"观察—猜想—验证—反思"的探究链条。其三,价值引导空间大。回归预测被滥用的案例并不少见,讨论模型边界、数据偏差与算法伦理,是本课不可或缺的育人环节。教学重点:理解线性回归的基本原理,掌握"训练—预测—评估"的完整流程,能用Python实现一元线性回归并解释结果。教学难点:最小二乘思想的直观理解;模型评估指标(均方误差)的意义;对"相关不等于因果""拟合不等于真相"的理性辨析。三、学情分析授课对象为高中二年级学生,年龄十六至十七岁,大部分学生修读过信息技术必修模块与选择性必修3。已有基础表现为:能读懂并改写简单Python程序,了解列表、循环、函数等结构;数学上学习过指数、直角坐标系与基本统计量,对"用直线描述数据趋势"有朴素的直觉;使用过电子表格软件,绘制过折线图和散点图。可能存在的困难集中在三个方面。第一,对"误差的平方求和再最小化"这一思想缺乏直观感受,容易停留在"照着代码敲"的机械模仿。第二,容易把回归模型神化,认为计算机算出的结果就是"标准答案",缺乏对模型假设与适用条件的审视。第三,部分学生编程速度差异明显,若任务设计单一,容易出现"快的等、慢的追"的局面,需要分层任务作保障。四、教学目标信息意识:能从真实问题情境中识别可量化的变量关系,判断哪些问题适合用回归方法尝试解决,对数据来源、样本规模保持敏感。计算思维:经历"数据可视化—提出拟合假设—训练模型—量化评估—反思修正"的完整过程,把现实问题抽象为数学问题,再转化为可执行的程序流程。数字化学习与创新:能借助Python及numpy、matplotlib、sklearn库自主完成一元线性回归实验,会阅读库函数文档,能通过修改参数、更换数据观察模型行为,形成用实证检验猜想的学习习惯。信息社会责任:能结合具体案例讨论回归预测的局限与风险,初步形成对算法结论进行批判性审视的意识,认识数据质量、变量选择背后的价值立场。五、教学方法与策略采用情境驱动下的探究式教学。以"身高与鞋码能否互相预测"的班级话题贯穿前后,以"奶茶甜度与销量"为主任务情境,组织学生四人一组开展小组协作实验。核心原理采用"脚手架式讲授",先让学生用手画线感知拟合,再用程序逼近最优解,最后引出最小二乘的数学描述,实现从直觉到形式化的三级台阶。任务单按"基础任务—进阶任务—挑战任务"三级设计,兼顾差异。评价上采用过程性评价与表现性评价并重,嵌入自评表与小组互评。六、教学准备硬件环境:机房,一人一机,可联网访问校园资源平台。软件环境:Python3.x,预装numpy、matplotlib、scikitlearn;安装包与离线whl文件存入机房共享盘以防网络波动。课前准备:教师预设三个数据集——数据集A为成对录入的身高与鞋码模拟数据(60条)、数据集B为某饮品店周销量与平均气温数据(52条)、数据集C为含明显异常值与缺失值的"脏数据"对照组;同时准备任务单、学习支架文档(含常用函数速查)与评价量规。七、教学过程(一)情境导入:一个"神算子"的破绽(约7分钟)上课伊始,教师现场邀请两名学生报出自己的身高,教师"掐指一算"报出他们可能的鞋码,误差很小,学生哗然。教师顺势展示一张散点图:横轴身高,纵轴鞋码,图中还有一条斜斜穿过的直线。教师提问:老师真的神机妙算吗?这条线从哪儿来?如果再有三个人报身高,你敢照着这条线给他们算鞋码吗?学生自由发言,多数能说出"数据越多越准""这是规律"之类的直觉判断。教师追问:规律是谁总结的——老师,还是数据本身?引出本课核心命题:让计算机代替我们,从数据中"学"出这条线。设计意图:用低门槛、强参与感的真实互动制造认知悬念,让学生在"被预测"的新奇体验中产生"算法怎么做到的"这一真问题,为整节课锚定学习动机。(二)新知建构:从手画到科学(约15分钟)环节一:直觉拟合。教师在平台推送一份只有8个数据点的小组可编辑散点图,请各组用鼠标在图上"凭感觉"画一条能最好代表趋势的直线,截图提交。大屏幕并排展示三四组的成果,差异立现:有的斜率大,有的平移高。教师设问:哪条线更好?凭什么说它好?"看起来还行"算不算科学依据?学生意识到需要一把"尺子"来度量好坏。环节二:误差的量化。教师以图上的三个点为例,依次讲解:每个真实点到直线有一条竖直方向的"距离",这个距离叫残差;点可能有偏上偏下,符号会打架,所以把距离平方后再相加,得到一个总和。教师现场写出示意表达式:总误差=Σ(y实际−y预测)²。讲解时配用手势比划"竖着的偏差""平方消号""累加求和"三个动作,不做更深的推导。环节三:最优的含义。教师指出,回归的任务,就是在所有可能的直线中,找到让总误差最小的那条;背后数学方法是"最小二乘",高中只需理解其思想,具体求参数交给库函数完成。此处强调一句关键观念:"最优"只在给定数据和直线假设的前提下成立,换数据、换假设,结论随之改变。设计意图:让学生先犯错误、再建规则,把"最小二乘"这个抽象概念还原为"给手画的线打分数"的朴素需求,突破本课最硬的认知难点,同时埋下"模型有条件"的思维种子。(三)任务驱动:让奶茶店老板心服口服(约18分钟)这是本课的核心实践环节。教师发布情境:学校附近一家饮品店老板发现天热时销量高,想根据气温提前备货,减少浪费。他攒了52周的"平均气温—杯数"数据(数据集B),希望得到一个可信赖的预测工具。基础任务(人人必做,参照支架文档)。第一步,读入数据并绘制散点图:```importnumpyasnpimportmatplotlib.pyplotaspltdata=np.loadtxt('sales.csv',delimiter=',',skiprows=1)x=data[:,0].reshape(1,1)平均气温y=data[:,1]销量plt.scatter(x,y)plt.xlabel('temperature');plt.ylabel('sales')plt.show()```第二步,训练模型并可视化拟合直线:```fromsklearn.linear_modelimportLinearRegressionmodel=LinearRegression()model.fit(x,y)plt.scatter(x,y)plt.plot(x,model.predict(x),color='red')plt.show()print(model.coef_,ercept_)```第三步,定量评估。计算均方误差mse=Σ(y实际−y预测)²/n,或用model.score获得决定系数。小组记录:斜率是多少?它的物理含义是什么?气温28度时预测销量多少?进阶任务(完成基础任务的小组选做其一)。其一,把数据按前40行训练、后12行"假装未知",检验模型对未来数据的预测误差,比较与全量评估的差异,体会"训练集与测试集"的朴素思想。其二,换用数据集A(身高鞋码),重复全流程,并写一句话说明两例中直线意义的异同。挑战任务(供学有余力者)。在数据集B基础上人为加入一个维度——是否周末,尝试用model.fit(X,y)代入两列特征,观察系数与误差的变化,初步感知多元线性回归。教师巡视要点:关注的不是代码跑通与否,而是小组能否说清"斜率代表什么""误差数字大不大、以什么为参照"。对进度滞后的组,提供半成品代码让其补全关键两行;对急于求成的组,故意追问"你这个预测敢让老板照着进货吗?差多少会出问题?"展示互评(约5分钟)。选取两组投屏汇报:一组侧重解释系数含义,一组侧重展示训练/测试误差对比。其他小组依据量规从"结果合理""解释清楚""质疑到位"三个维度打分,教师即时点评。设计意图:以真实经营决策为负载,将算法流程落实为可交付的"预测工具",迫使学生超越"跑通代码"的浅层目标,走向对结果的解读与辩护;分层任务让不同起点的学生都能获得成就感。(四)批判辨析:模型也会说错话(约8分钟)教师推送数据集C:与原数据几乎相同,但混入两条录入错误(销量多敲了一个零)和若干缺失值。各小组直接套用刚才的程序跑一遍,绘制图形,观察直线被"带偏"的现象。围绕三个问题展开全班研讨。第一,仅仅多了两个错数据,预测结果变化有多大?这提醒我们开工前必须做什么?引导学生说出"先看数据、清洗数据、处理异常值"。第二,气温和销量高度相关,那么"气温升高导致销量增加"成立吗?再举一例:冰淇淋销量与溺水事故高度相关,能据此说冰淇淋导致溺水吗?学生在笑声中接受"相关不等于因果"。第三,如果一家学校用"刷题时长"回归预测成绩来给学生排名分班,可能冤枉谁、漏掉什么变量?讨论触及样本偏差、遗漏变量与算法决策的公平性。教师小结两点立场:数据是模型的粮食,垃圾进、垃圾出;模型是工具而非裁判,人始终要对结论负责。设计意图:把信息社会责任目标落在具体可感的实验反差上,而非口号说教;通过反例体验建立对算法权威的合理怀疑,这是人工智能素养的核心。(五)课堂小结与作业布置(约4分钟)师生共同梳理知识链条:观察散点提出假设→用残差平方和衡量拟合优劣→训练模型获得最优直线→用误差指标评估→用批判眼光审视结论。教师用一句话收束:回归不是预言家,它只是把过去的规律借给未来用,用不用、怎么用,看人。分层作业。必做:撰写本课实验报告,回答"我的模型能帮老板省多少浪费、可能在什么情况下失灵"。选做:采集本班同学的鞋码与身高真实数据(匿名处理),自建数据集完成回归,与课前教师的"神算"对比;或查阅资料,说明一元线性回归与下一单元将学的逻辑回归在任务类型上的根本区别。八、板书设计主板书以流程图为骨架横贯黑板:数据→散点图→拟合直线(残差→平方→求和→最小)→训练→预测→评估(mse)→审视结论。副板书右侧记录学生研讨中生成的关键词:相关≠因果、垃圾进垃圾出、人负责。关键公式总误差=Σ(y实际−y预测)²居中突出,配以一条手绘直线与两个残差线段的简图,保证离开教室前拍照即能带走完整知识地图。九、教学评价设计采用"三维联动"评价。过程性评价依托平台记录各组任务完成节点与代码提交历史,关注调试策略与合作分工而非一次性结果。表现性评价使用四档量规,从"原理理解、程序实现、结果解释、批判反思"四个维度由小组自评、组间互评与教师评定各占三分之一加总。诊断性评价在课后通过三道在线小题完成:一题辨析时点概念(残差的定义),一题给定输出结果判断合理性,一题开放简述一个不宜用回归预测的校园问题并说明理由。评价结果不排名,反馈到个人的是具体的改进建议。十、教学特色与预设反思本设计有三处着力点。一是"具身化的数学":用画线、比划残差、对比打分把最小二乘从黑箱变成学生亲手掂量过的工具。二是"有代价的真实":奶茶备货情境自

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论