版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
高中一年级信息技术必修1编程处理数据第一课时教学设计一、基本信息与教材定位本课选自浙江教育出版社高中信息技术必修1《数据与计算》第四章第二节第2部分"编程处理数据",安排两课时完成,本文为第一课时。授课对象为高一年级学生,他们已在第三章初步接触了Python基础语法,会写顺序结构与分支结构的小程序,但绝大多数学生尚未建立"用程序批量处理数据"的真实经验。本课处在教材"数据采集—数据整理—编程处理—数据可视化"链条的关键节点,前承4.1用电子表格处理数据,后启4.3大数据处理,是学生从"手工操作工具"走向"编写程序解决问题"的第一次真正跨越。课程标准对本课的要求可以概括为:通过实例认识编程处理数据的意义,掌握用Python读写文件、运用pandas等模块对数据进行整理与统计分析的基本方法,体会程序处理海量数据的效率优势。本课在落实学科核心素养上,重点指向计算思维与数字化学习与创新:学生要把一个真实的数据处理需求抽象为算法步骤,再分解为代码实现,最后用执行结果验证自己的思路。二、学情分析笔者在课前对任教班级的四十八名学生做了摸底,结果显示:会独立写出for循环遍历列表的学生约占七成;能读懂包含字典结构的代码的学生约占五成;接触过文件读写语句的不足两成;听说过pandas模块的仅有个别学生。这组数据说明,学生对"数据在内存中"的操作已有一定基础,但"数据在磁盘上、以文件形式存在、需要读取与写回"这一认知几乎是空白,而文件读写恰恰是编程处理数据的第一步。认知特点上,高一学生抽象逻辑能力正在形成,但对纯代码讲授的耐受度低,必须依托真实情境。本校地处县城,学生日常接触外卖、快递、校园一卡通等数据服务,具备理解"消费记录""成绩记录"这类表格数据的生活经验。因此本课选取"班级体质健康测试数据分析"作为贯穿情境,数据量约五十行,既小到可以手工核对验证,又大到让学生感到逐条计算很烦,天然形成"有必要用程序"的心理张力。三、教学目标知识与技能:理解编程处理数据的基本流程,即读取数据、分析处理、结果输出;掌握用Python内置open函数读写csv文件的基本方法;初步学会使用pandas模块中的read_csv、describe、groupby等方法对数据进行汇总统计。过程与方法:经历"手工试算—脚痛思变—程序化迁移—对比验证"的完整过程,体验将重复性计算抽象为循环结构、将统计需求抽象为函数调用的思维方法。情感态度与价值观:在分析本班体测数据的过程中形成用数据说话的意识,认识程序处理海量数据的效率优势,同时讨论数据使用的边界,树立负责任的数据观。教学重点:编程处理数据的基本流程;pandas模块中常用统计方法的使用。教学难点:把现实统计需求拆解为可编码的操作步骤;理解DataFrame对象的基本组织方式。四、教学策略与资源准备本课采用任务驱动与问题链引导相结合的策略,以"体检数据在哪里—表格工具哪里不够用—程序如何接手—程序怎样更优雅"为问题主线,设计四个递进任务。教学方法上,前二十分钟以教师引导下的师生共同探究为主,后段以学生分组编程实践为主,教师巡视点拨。资源准备方面:机房安装Python3.x环境及pandas模块,课前在每台学生机的D盘新建data文件夹,放入bm_test.csv(本班体测数据的脱敏版本,姓名以学号代替,含性别、身高、体重、肺活量、50米跑、坐位体前屈六列)与city_bmi.csv(某市万名初中生体质抽测数据)两个文件;教师机配备投屏软件,用于实时展示学生代码与运行结果;另准备一份学习单,包含任务说明、留白的关键代码框架和自我评价表。五、教学过程(一)情境导入:一张让人头疼的表格8分钟上课伊始,教师投屏展示bm_test.csv的前几行预告,并提出真实需求:体育组交来本班体测数据,校医务室需要在今天下午前得到三项统计结论,一是全班各测试项目的平均分,二是男女生肺活量的对比,三是依据体质测试标准统计体重指数处于正常区间的学生占比。教师请学生估算完成这三项工作的方式与耗时。学生自然反应是用电子表格软件打开,用函数求平均。教师顺势追问:如果不是一个班,而是全市一万名学生的数据,而且每周更新一次,每次都要重做同样的统计,你还愿意一条条点鼠标吗?学生在笑声中摇头。教师小结:当数据量大、处理步骤重复、任务需要反复执行时,最适合的主角不是鼠标,而是程序。板书课题:编程处理数据。设计意图在于,用一个具体的一次性任务和一个夸张的延伸场景,让学生同时看到表格工具的可行性与局限性,从而对程序化方案产生真实需求,而非被告知"程序很重要"。(二)探究一:让程序先看见数据,12分钟教师提问:程序不像人眼能直接看屏幕,它如何拿到文件里的数据?引导学生回忆第三章学过的input函数只能接收键盘输入,进而推出程序需要一种"从文件读数据"的机制。教师演示最朴素的文件读取方式。先写读文本的基本语句:用open打开bm_test.csv,用readlines按行读入,print查看前三行。学生观察到每行是一个字符串,字段之间以逗号分隔。教师随即追问:字符串形式的年龄数据25,能做加法吗?学生回答必须先转换类型,还要按逗号拆分。教师板书手工处理的三步:按行读、按逗号切、逐字段转类型,并现场写出对应的简单代码运行验证。运行成功后,教师不急于讲模块,而是让学生亲手体验"朴素方法的繁琐":布置微任务,要求学生统计前五行身高之和。学生需要写循环、切片、类型转换,多数学生在三到四分钟内完成,但普遍反映代码冗长、容易出错。教师趁热打铁,引入pandas模块。演示三行核心代码:导入pandas,用read_csv读取文件,直接打印查看数据。学生看到整齐对齐的表格瞬间出现在终端,发出惊叹。教师讲解DataFrame的本质——一张存在内存中的二维表,列叫Series,行有索引,并指导学生用head、shape、columns等属性"看清"这张表。这一环节的设计取意"先尝苦后知甜":让学生亲身体验基础语句处理结构化数据的繁琐,再引入pandas,学生对模块的价值理解是内生的,而不是机械背诵。(三)探究二:让数据开口说话,15分钟本环节围绕三个统计需求逐一攻破,采用"需求—思路—代码—验证"四步走模式。需求一:各项目平均分。教师先问思路,学生回答"对每列数值求平均"。教师演示两种实现:对单列使用mean方法,对整张数值表使用describe方法。运行后请学生描述describe输出的统计量含义,区分count、mean、std、min与四分位数。教师强调一句易被忽略的话:describe给出的不只是结果,更是一次"数据体检",能一眼看出有没有异常值。例如50米跑一列的min值为2.1秒,明显不可能,教师引导学生思考原因——录入错误,真实数据来源也需要谨慎核对,这恰是程序处理数据较之手工的一大优势:异常会被统计结果放大暴露。需求二:男女生肺活量对比。教师提示关键词"分组",带领学生类比电子表格中"先筛选再求均值"的操作,选出对应的pandas方法groupby。师生共同完成代码:按性别列分组,取肺活量列,求均值。运行后,教师请两名学生说出数值差异,并引导思考均值是否足以代表整体,引出下一课参观的可视化工具悬念。需求三:体质正常区间占比。这是本课真正的难点,需要布尔条件筛选加计数。教师先让学生用手工思路回答:身高体重各除以一百换算单位,体重除以身高的平方得到体质指数,落在某个区间即视为正常。再过渡到程序写法:新增一列用于存储体质指数,用条件表达式做行筛选,用len或size统计行数,最后一行做除法得到占比。教师强调新增列的写法直观展示了"程序可以像脑子一样构造新数据"。每个需求完成后,教师坚持让学生手工抽查一两行数据验证程序结果,向学生传递"不迷信程序输出,验证是计算思维的一部分"的职业习惯。(四)探究三:从小数据走向大数据,10分钟教师切换文件,把bm_test.csv换成city_bmi.csv,代码几乎一字不改,仅调整列名。学生按下运行键,万名学生的统计结果在不到一秒内呈现,教室响起惊呼。教师请学生对比前后两次运行人为感受到的时间差异,体会O(n)级别遍历在现代机器上的惊人速度。这个体验环节的设计意图是让学生亲历"代码不变、数据规模放大、结果自行扩展"的过程,理解可重用性与可扩展性才是编程处理数据的灵魂。教师进一步提问:如果把所有数据都堆砌到一个文件不好找,怎样让程序自动处理一个文件夹里的三十个csv?学生基于已有经验能迁移出循环读文件的想法,为课后拓展作业埋下伏笔。教师要顺势处理的还有数据伦理问题。教师展示一份未脱敏的原始数据片段,问学生是否可以直接上传互联网分析。学生讨论后认为应先去除姓名、学籍号等可识别信息。教师明确指出:数据处理的每一步都要问一句,这是否涉及他人隐私、是否获得授权。这一段讨论虽短,却是对学生信息社会责任素养的必要滋养。(五)课堂小结与作业布置,5分钟师生共同回顾本课流程,归纳出编程处理数据的四个环节:读入数据、认识结构、按需分析、验证输出。教师用一张简化的流程图呈现四者关系,重点标出"验证"是闭环的最后一环。学生当堂完成学习单上的自评表,项目包括:我能读懂csv文件的含义;我能用pandas读入数据并查看结构;我能对单列或多列做基本统计;我能根据需要简单筛选记录。作业布置分基础与拓展两层。基础层:完成学习单上两组代码的填空与注释,明天课前交。拓展层:尝试用本课方法分析自己感兴趣的一份公开数据集,可从国家统计局或体育类公开数据中选一份csv文件,写出三条你发现的有趣结论。教师特别提醒,遇到困难优先查阅pandas官方文档的入门示例,学会使用文档本身就是数字时代最重要的学习能力之一。六、板书设计本课板书分三区布局。左区书写流程主线:读数据→识结构→做统计→验结果。中区保留核心代码三条:importpandasaspd;df=pd.read_csv('bm_test.csv',encoding='gbk');df.describe。右区记录课堂生成的问题与学生的精彩回答,例如"均值不代表全部""程序输出也要核查"等,让学生在笔记中保留争议的现场感。七、教学资源的开发思路本课所用数据均来自真实情境的脱敏版本。bm_test.csv由体育教师配合整理,字段命名采用拼音缩写,便于学生对照现实中的体测记录册。city_bmi.csv取自公开抽样数据的模拟再生成版本,保留真实分布特征。这种"小而真"的数据集设计兼顾课堂流畅性与认知真实性,避免了虚构数据的不可信感。配套的微资源还包括一段三分钟微视频,演示从零安装pandas到运行第一个read_csv语句,供课后操作困难的学生反复观看;一个在线协作编辑的讨论帖,学生可将自己处理的数据与代码贴上来互相评价。八、教学评价设计诊断性评价通过课前摸底完成,已在前述学情分析中体现。过程性评价嵌入三个探究环节,教师通过巡视观察学生的代码编写速度、提问质量与同伴互助情况作出判断,重点关注谁能快速把需求翻译成语句、谁会主动验证结果、谁能耐心帮同伴查错。总结性评价采用上机成果加学习单双轨制:上机成果看三项统计是否正确完成,学习单看代码注释是否清晰、自评是否诚实。两级评价结合,既鼓励能跑出正确结果的学生,也肯定那些思路清晰但代码还没完全调通的学生,避免单一的胜负观挫伤初学者的自信心。九、教学反思的预设与改进方向在多次执教本课后,笔者有几条稳定的改进体会。其一,时间控制上,第一课时务必在三项统计中只完整完成两项,第三项留给第二课时,否则学生会因赶进度而放弃思考,直接照抄示例代码,真正发生学习的机会反而减少。其二,pandas模块的首次引入宜坚持"最小可用"原则,只讲导入、读取、描述、分组四件事,其余神奇方法留待学生自行探索,避免一节课把学生灌满。其三,分组策略上,异质四人小组优于两人结对,组内固定设一名"
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 赛事直播服务合同
- 蛋糕装饰师保密意识模拟考核试卷含答案
- 农化技术员操作规程模拟考核试卷含答案
- 燃气管网运行工岗前安全宣传考核试卷含答案
- 营林试验员安全防护模拟考核试卷含答案
- 松香蒸馏工安全行为测试考核试卷含答案
- 沼气生产工安全综合评优考核试卷含答案
- 兴趣点地理信息采集员岗位离岗考核试卷含答案
- 冷压延工安全生产意识测试考核试卷含答案
- 生活垃圾收集工岗中质量考核试卷含答案
- JJF(京)158-2025 大气预浓缩仪校准规范
- 公司环境保护与节能减排制度
- 大闸蟹劵销售合同
- 2026年4月自考02333软件工程试题及答案
- 2026年初级安全工程师实务《化工安全》试卷真题(答案解析附后)
- 2026年消控证(中级)考集合试题带答案详解AB卷
- 民进班子成员工作制度
- 综合门诊部工作制度
- 企业安全生产费用提取和使用管理办法(财资2026年136号文附件)
- 道路旅客运输及客运站管理规定2026版
- 2025年广投集团招聘笔试题目及答案
评论
0/150
提交评论