高中信息技术必修1数据处理主题教案:用pandas与matplotlib让数据说话_第1页
高中信息技术必修1数据处理主题教案:用pandas与matplotlib让数据说话_第2页
高中信息技术必修1数据处理主题教案:用pandas与matplotlib让数据说话_第3页
高中信息技术必修1数据处理主题教案:用pandas与matplotlib让数据说话_第4页
高中信息技术必修1数据处理主题教案:用pandas与matplotlib让数据说话_第5页
已阅读5页,还剩4页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

高中信息技术必修1数据处理主题教案:用pandas与matplotlib让数据说话一、教学设计背景与学情分析本课面向高中一年级学生,对应必修模块《数据与计算》第四单元的核心内容,主题是运用Python的pandas模块与matplotlib模块完成数据的读取、加工、分析与可视化表达。学业水平考试对该部分的考查呈现三个特点:一是以真实情境数据为载体,考查学生读取外部文件、筛选数据、统计汇总的基本操作;二是以图表补写代码为常见题型,考查matplotlib绘图语句的识读与补全能力;三是强调计算思维与数据素养的综合运用,要求学生会看数据、会提问题、会用工具、会得结论。从学情看,学生已经掌握Python基本语法,能够书写顺序结构与循环结构的简单程序,但对"库"的概念理解不深,容易把pandas当作一种新语言来背。班级中约三分之一的学生在程序补写题上失分严重,主要症结在于不理解Series与DataFrame的数据组织方式,混淆iloc与loc的用法,对groupby分组汇总的执行过程缺乏脑中的运行图景。因此本课不能以逐条讲函数为主线,而应以一个贯穿始终的真实数据问题为线索,让学生在解决问题的过程中自然触碰各个知识点,再通过变式训练完成巩固与迁移。二、教学目标1.知识与技能目标。学生能够说出pandas中Series与DataFrame的结构差异,能够使用read_csv读取本地数据文件,能够运用条件筛选、列运算、sort_values排序、groupby分组聚合完成常见数据处理任务;能够使用pyplot完成折线图、柱状图、散点图、饼图的绘制,并理解xlabel、ylabel、title、legend等要素的作用,能够通过rcParams设置解决中文显示乱码问题。2.过程与方法目标。学生经历"提出问题—读取数据—清洗加工—分析统计—可视化呈现—表达结论"的完整数据处理流程,体会数据驱动决策的思维方式,形成先观察数据结构再动笔编码的工作习惯。3.情感态度与价值观目标。学生在真实数据分析中感受信息技术学科的工具价值,树立用数据说话、以证据支撑观点的理性态度,认识数据安全与数据来源可靠性的重要意义。三、教学重点与难点教学重点是DataFrame的条件筛选、groupby分组聚合与matplotlib基本绘图语句的综合运用。教学难点有二:一是理解条件表达式如df[df["体温"]>37.3]背后的布尔索引机制,让学生明白方括号中装入的是一个"条件判断结果序列"而非一句命令;二是将分析结论与图表关联,做到图表与观点相互印证而非为了画图而画图。四、课前准备教师准备:机房全员能运行Python并预装pandas与matplotlib;准备某中学三个年级学生体测成绩数据文件test.csv,包含学号、年级、性别、身高、体重、50米跑、立定跳远等字段,人为埋入少量缺失值与异常值;准备学案纸质稿与配套半成品代码文件;演示用教学课件嵌入运行界面截图。学生准备:回顾Python列表、字典与for循环知识,完成学案预习部分的两个小题。五、教学过程(一)情境导入:一张表格引发的争论,八分钟教师打开电子表格文件,向全班展示体测数据的前二十行,提出一个贴近生活的问题:有人说"高年级同学学业紧张、锻炼时间少,体测水平一定不如低年级同学",这个说法站得住脚吗?教室里迅速出现两派意见。教师顺势追问:我们没有时间把六百多行数据逐行核对,能不能让计算机替我们快速地、可信地回答这个问题?这一导入的设计意图在于制造认知冲突。学生凭经验给出的答案互相矛盾,唯有数据能成为裁决者。教师随即板书本节课的任务主线:读数据、理数据、看数据、说数据。四步流程写在黑板左侧,整节课不擦除,作为学生思维的路标。导入学业水平考试近年真题中频繁出现的"读代码填结论"题型,让学生意识到本节课所学即所考、所考即所用。(二)任务一:把数据请进程序,十二分钟教师在屏幕上逐行演示导入模块与读取数据的代码。第一行importpandasaspd,教师提问:为什么要写aspd?学生经过思考给出"缩写调用方便"的答案,教师补充这是业内约定的惯例写法,就像给工具箱挂一个顺手的标签。接着执行pd.read_csv("test.csv")的等价操作,将结果赋给变量df,使用df.head()查看前五行,用df.shape查看行列数,用df.dtypes查看每列的数据类型。此处教师安排一个"一分钟观察"环节:请同桌两人互相说一说这个表格对象有几列、姓名列与成绩列在类型上有什么不同。这一环节看似平凡,实则是数据处理中最重要的职业习惯——先看清数据长什么样子再动手。教师强调DataFrame可以比作电子表格,列有列名即"表头",行有行号即"索引";单列抽出来就是Series,是带了索引标签的一列数据。随后教师引导学生发现数据中的异常:身高列出现空值,50米跑成绩列出现负数。教师提问:脏数据如果不处理会怎么样?学生理解"垃圾进、垃圾出"的道理后,教师演示用df.dropna()删除缺失行,演示条件筛选剔除负值记录的写法df=df[df["费50米"]>0]。此处第一次出现布尔索引,教师放慢速度,把条件表达式拆开讲解:外层方括号做一次"选取动作",内层df["费50米"]>0对每一行计算出一个True或False,True的行被留下,False的行被丢弃。为帮助学生形成脑内图景,教师用红蓝两色在投影上标出保留行与丢弃行。(三)任务二:从庞杂表格中提取有用信息,十五分钟教师提出递进式的三个小问题,学生按小组在半成品代码上补全并运行验证。第一个问题:全年级跑得最快的同学50米成绩是多少?学生尝试使用列的min方法,即df["费50米"].min()。教师巡视时重点观察学困生是否把列名写错引号,提醒列名是字符串。第二个问题:男生和女生的立定跳远平均成绩分别是多少?这是本课第一次出现分组思维。教师先让学生用自己的话说操作过程——"按性别这一列把全班分成两组,每组分别算平均数",再用语言对应到代码df.groupby("性别")["立定跳远"].mean()。教师用图示解释groupby的执行逻辑:先按分组键把表格"切"成若干小块,每块独立计算聚合值,最后把结果拼成一个新的带标签的表。教师特别强调聚合动词可以替换为sum、count、max、min,让学生现场把mean换成max再运行,观察结果变化,体验"换动词、换问法"的灵活性。第三个问题:哪个年级的立定跳远平均分最高,各年级之间差距有多大?学生把分组键换成"年级"列完成计算,教师请两组学生到讲台前展示结果并口头报告结论。报告必须遵循句式"我从……列数据出发,用……方法计算,得到……",用规范表达训练数据素养。此阶段教师穿插讲解排序操作df.sort_values("立定跳远",ascending=False),让学生在排序结果中一眼找出跳远成绩最好的五个同学,并思考升序降序参数的含义与默认方向。(四)任务三:让数据自己开口说话,十五分钟教师抛出问题:一长串分组后的数字看起来还是不够直观,有没有办法让它一目了然?学生自然想到图表。教师引入matplotlib,书写导入语句importmatplotlib.pyplotasplt,并解释pyplot是其中专门负责画图的子模块。图表一:各年级立定跳远平均分的柱状图。教师逐行讲解:plt.bar(x轴数据,y轴数据)负责画柱形主体;plt.xlabel、plt.ylabel为两条轴标注含义;plt.title添加标题;plt.show()负责把图显示出来。运行后学生立刻发现标题与轴标签中的中文显示为方框乱码。教师不急着给答案,先让学生猜想原因,告诉学生这是绘图库默认字体不含中文字形所致,随后演示两行设置:plt.rcParams["font.sansserif"]=["SimHei"]与plt.rcParams["axes.unicode_minus"]=False,并说明前者指定黑体作为字体、后者保证负号正常显示。这个"故障—诊断—修复"的过程远比直接给答案更能留在学生记忆里,也是学业水平考试中常见的程序补写点。图表二:50米成绩与身高的散点图。教师引导学生思考:身高较高的同学是否跑得更快?用plt.scatter(df["身高"],df["费50米"])绘制散点,让学生观察点的分布是否有明显趋势,体会散点图用于观察两个数值变量之间关系的用途。图表三:各年级人数占比的饼图。学生使用plt.pie结合labels与autopct参数绘制,观察年级人数构成。教师引导学生进行比较三种图形的适用场合:柱状图比多少,折线图看变化,散点图看关系,饼图看占比。配合一道教材式思考题:"如果我要看某位同学一学期五次体测成绩的变化走势,应选哪种图?"全班齐答折线图,教师用plt.plot演示同组数据的折线呈现,并讲解图例legend在多条折线并存时的区分作用。(五)任务四:综合挑战——完整回答课前争论,十分钟学生回到开课时的争论问题,以小组为单位完成完整分析链:读取清洗好的数据,按年级分组统计50米跑与立定跳远的平均分,绘制双柱状对比图或分组条形图,撰写一段不超过五十字的结论。教师提出结论书写的三条标准:有数据支撑、有图表引用、有必要限定词。各组展示环节,教师引导学生互评:结论是否夸大?图表是否与结论匹配?坐标轴是否标注完整?典型的小组结论如:"高一年级50米跑平均成绩8.3秒,高二8.5秒,高三8.7秒,年级越高短跑成绩略有下降,但立定跳远三个年级相差不足2厘米,'高年级体测明显不如低年级'的说法证据不足。"教师点评指出这种既不盲从直觉、也不夸大差异的表达正是科学精神所在。(六)课堂小结与结构梳理,五分钟教师回到黑板上的四步路标,请学生依次说出每一步对应的关键代码,师生共同完成板书思维图:读数据对应read_csv与head;理数据对应条件筛选、dropna、列运算、sort_values;看数据对应groupby聚合与三种统计图形;说数据对应基于证据的结论表达。教师特别提醒易错三处:列名必须加引号;布尔索引内层是条件表达式而非命令;绘图后必须有show才会显示,中文标题须先设置字体。(七)分层作业设计基础层:在学案给出的校园图书借阅数据上完成指定筛选与平均借阅量计算,补全柱状图代码中的三处空缺,回归学业水平考试典型题型。提高层:自选生活数据,如家庭一周开支或班级一周天气记录,完成从读取到可视化的全流程,写一段结论。挑战层:尝试用两次分组键实现"年级与性别"二维分组统计,并探索水平柱状图barh的画法。六、板书设计黑板分为三区。左区为流程路标"读—理—看—说"四个大字贯穿整节课;中区为核心代码骨架,自上而下依次是导入模块、读取文件、布尔筛选、分组聚合、绘图五行要素;右区为易错提醒角,粉笔列出列名加引号、条件用布尔索引、show不可省、中文先设字体四条。三区内容随教学推进逐步生成,结课时构成一幅完整的知识结构图,学生拍照即可作为复习提纲。七、教学评价设计本课采用过程性评价与结果性评价相结合的方式。过程性评价依托学案上的四个任务检查点,教师巡视时用评价表记录每组在"代码正确、能解释机理、能口头报告"三个维度上的表现;结果性评价则对接学业水平考试要求,以读程补写题和数据解释题为载体,考查学生能否在陌生数据情境中迁移运用本课方法。评价标准突出思维含量:只写对代码得基本分,能讲清执行过程得良好分

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论