版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
高中一年级信息技术必修1用pandas处理数据(第二课时)教学设计一、教学内容分析本课选自浙教版(2019)高中信息技术必修1《数据与计算》第四章第二节,是"利用pandas模块处理数据"的第二课时。学生在第一课时已经认识了pandas的基本数据结构Series与DataFrame,能完成文件读取、数据查看、列选取等基础操作。本课时承接前课,聚焦数据的加工与分析:条件筛选、排序、统计计算、分组聚合,让原始数据转化为认知,为后续"数据分析与可视化"一节铺路。教材安排贴近生活,以天气、销售等真实数据为例,来自生活、用于生活,契合新课标"数据源于生活、价值归于生活"的立意。二、学情分析教学对象为高一年级学生。他们已具备Python基础语法与pandas入门知识,但多数停留在"照着敲"的阶段,对"为什么这样组织代码"缺少理解。学生对Excel的筛选、排序比较熟悉,这是可迁移的学习起点;但用代码表达"某列大于某值且另一列等于某类"这样的复合条件,仍是普遍性难点。此外,高一学生数据处理的经验零散,缺乏"提出问题—选择方法—验证结果"的完整分析意识,需要通过案例任务驱动加以固化。三、教学目标1.信息意识:能从真实情境中发现数据问题,认识到原始数据需要加工才能支撑决策。2.计算思维:掌握布尔索引、sort_values、describe、groupby等核心方法的逻辑,会用链式思路分解复杂数据处理任务。3.数字化学习与创新:能借助文档、报错信息自主调试代码,尝试用所学方法解决数据集之外的变式问题。4.信息社会责任:在分析校园真实数据的过程中,形成尊重数据、如实呈现结果的态度,理解数据误用的危害。四、教学重难点重点:条件筛选的布尔逻辑表达、分组聚合"groupby"的语义理解。难点:复合条件的括号优先级问题;分组结果与原始数据形状差异的理解。五、教学准备机房预装Anaconda与JupyterNotebook环境;准备"某班体测成绩表.csv""某市一周气象数据.csv"两份数据集;学习单包含任务阶梯与拓展挑战;教师端配备代码演示屏控软件。六、教学过程环节一情境导入:数据会说谎吗上课伊始,屏幕抛出两份表格截图:一份是某商品店一星期的"最高气温—冷饮销量"原始记录,一份是整理后的结论"气温越高,销量越好"。提问学生:这份结论是怎么从左边那张表钻进右边那句话的?学生凭经验说出"要挑数据""要算一算"。教师顺势点题:今天就让pandas替我们做这件事——从一百行数据里,挑出有价值的十行,再算出一句可信的话。环节二温故拾遗(5分钟)学生独立完成微练习:读取"体测成绩表.csv",用head()查看前5行,取出"姓名"和"800米成绩"两列。教师巡视,观察学生是否记得df[["列1","列2"]]的双层方括号写法,对遗忘者用一句"里面是列表,外面是取列"点拨,不直接代写。环节三探究一:条件筛选——让数据只留想要的部分任务:找出体测表中"800米成绩小于240秒"的同学。教师先让学生尝试自然语言翻译为代码,有学生写出df[df["800米"]<240],教师追问:外层方括号里装的到底是什么?现场演示在单元格中单独运行df["800米"]<240,输出一串True和False。学生恍然:筛选的本质是"用一串布尔值去挑行"。进阶任务:筛选"成绩小于240秒且女生"的记录。此为本课第一个难点。教师故意示范错误写法df[df["800米"]<240anddf["性别"]=="女"],让学生直面报错,再展示正确写法df[(df["800米"]<240)&(df["性别"]=="女")],引导对比:pandas里用&和|,每个条件都要用小括号包住。给出口诀化提醒——"条条括号,与用&,或用|"。学生在变式练习中完成"成绩大于300秒或重度超重"的筛选,巩固逻辑或的写法。环节四探究二:排序与统计——让数据排好队、算出数任务:将全体同学按800米成绩升序排列,取前3名;再用describe()生成全部数值列的统计概览。学生操作df.sort_values("800米"),教师抛出问题链:默认是升序还是降序?ascending参数怎么改?如何同时按两列排?学生试验df.sort_values(["班级","800米"]),理解多关键字排序的规则。随后运行df["800米"].describe(),屏幕出现count、mean、std、min、25%、50%、75%、max一行行数字。教师不逐条讲解,而是组织一个"读图说话"活动:你从这些数字里能向体育老师提什么建议?学生发现std偏大说明两极分化,50%分位与mean接近说明分布对称等,体会统计量是有语义的,不是数字堆砌。环节五探究三:分组聚合——本课的核心硬仗任务:分别计算各班800米的平均成绩,找出整体耐力最强的班级。学生面对"按班级分开算"的需求,第一反应往往是筛三次再各算一次。教师肯定其思路可行,再亮出groupby:df.groupby("班级")["800米"].mean()逐词拆解语义:groupby是"按班级把行拢成一捆一捆",["800米"]是"每捆里只取这一列",mean()是"每捆各自求平均"。配合板书图示,将原表画成被虚线分成三块的表格,每块下方落一个数。学生建立"分组—取列—聚合"三步心智模型。挑战题:各班男女生分别的平均成绩——提示使用两个分组键groupby(["班级","性别"])。学有余力的学生完成,组内互助讲解。环节六综合应用:完整数据分析小项目(15分钟)切换至气象数据集,任务卡要求:从"某市一周气象数据.csv"中,完成①筛出最高气温超33℃的高温日;②计算各天气类型(晴、多云、雨)下的平均降水量;③排序找出最湿热(湿度最高)的一天,并用两句话向全班汇报你的发现及依据。学生两人一组协作,教师流动指导,重点关注三种典型问题:复合条件漏括号、groupby后忘记选列、把文本列当数值列求均值。临近结束,每组用一分钟展示结果。教师评价不只对答案,更评价"你从数据到结论的链条是否完整"。环节七总结延伸(5分钟)师生共同梳理板书成一条主线:取数—筛选—排序—统计—分组—得结论。布置分层作业:基础层整理本课代码成个人速查笔记;提高层自主寻找一份公开数据(如自己一个月的运动记录),用至少三种方法完成一次分析,下节课用三分钟分享。七、板书设计主板书按"数据分析流水线"横向排布:读入→筛选(布尔索引,&|括号)→排序(sort_values)→统计(describe/mean)→分组(groupby三步)→结论。副板书留置学生易错点:复合条件加括号、groupby后记得选列。八、
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 播音考试高频试题及答案解析
- 2026年社会福利院招聘考试模拟试卷及答案
- 2026年经济师初级人力资源管理培训试卷冲刺版
- 2026年生态环境保护知识考试及答案
- 国学拓展试题及答案50个
- 2025-2026年公务员(国考)之行政职业能力测验题库检测试卷A卷附答案
- 2025~2026学年广东省东莞市长安振安学校七年级历史下学期期中学情检测试卷
- 2025~2026学年山东省威海荣成市16校联考(五四制)统编版七年级下学期质量检测历史试卷
- 《一个粗瓷大碗》课件
- 2026年人教PEP版(新教材)英语六年级上册教学计划(含进度表)
- 2026-2027学年二年级语文上册第一单元检测试卷统编版
- 2025年北京市丰台区教育系统事业编人员招聘笔试试题及答案详解
- 2025年中级会计经济法真题及答案解析一
- 苏州工业园区胜浦街道2026年社工招聘考试【结构化面试题库+高分答题模板】(含考官评分要点)
- 2026年秋季九年级道德与法治上册教学计划
- 《拍摄剪辑》教案-2026-2027学年人教版(新教材)小学美术六年级上册
- 2026小学语文新教材培训:新修订教材衔接教学建议
- 农田退水净化治理工程规划实施技术方案
- 医用高分子降解性能检测技术展望
- 2026年教师师德师风知识专项测试卷及答案
- 2026年幼儿园时食品安全培训
评论
0/150
提交评论