高中一年级信息技术必修一《数据采集的方法和工具》教学设计_第1页
高中一年级信息技术必修一《数据采集的方法和工具》教学设计_第2页
高中一年级信息技术必修一《数据采集的方法和工具》教学设计_第3页
高中一年级信息技术必修一《数据采集的方法和工具》教学设计_第4页
高中一年级信息技术必修一《数据采集的方法和工具》教学设计_第5页
已阅读5页,还剩6页未读 继续免费阅读

付费下载

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

高中一年级信息技术必修一《数据采集的方法和工具》教学设计一、教学设计的总体构想数据采集是整个数据处理链条的起点,也是粤教版高中信息技术必修一第五章"数据处理和可视化表达"的开篇内容。学生在第一章已经建立了"数据是对客观事物属性的记录"这一基本认识,在第二章体验了算法与程序设计的基本思想,但"数据从哪里来""如何让计算机替我们获取数据"这两个问题,对他们而言仍然停留在模糊的生活经验层面。本节课的任务,就是帮助学生完成从"被动使用数据"到"主动获取数据"的角色转变,使其理解人工采集与自动化采集的本质差异,掌握传感器采集、网络爬虫采集的基本原理,并在真实问题情境中选择恰当的方法与工具。本课依据课程标准中"了解数据采集的基本方法,能够根据需求选用适当的工具获取数据"的学业要求展开设计,同时关注计算思维中"抽象与自动化"两个维度。设计的核心思路是:以"校园食堂就餐拥挤程度调查"这一学生身边的真实问题为主线,让学生在解决问题的过程中经历"提出需求—比较方法—动手采集—审视来源"的完整过程,使方法的习得嵌入问题解决之中,而不是孤立地讲解概念与演示软件。考虑到高一学生认知水平参差的现实情况,教学设计采用"低门槛进入、高天花板拓展"的策略。全体学生完成基础任务,学有余力的学生挑战爬虫任务的变式,确保每一个学习个体都能在原有水平上获得发展。二、教学内容与学情分析本节教学内容包含三个层次。第一层是数据采集的基本概念,即通过一定的方式和手段,将客观事物的数据收集起来的过程。第二层是数据采集的常用方法,按照自动化程度可以分为人工采集(问卷调查、访谈、实地观察记录)和自动采集(传感器采集、网络爬虫采集、日志文件分析)。第三层是采集过程中需要遵循的基本规范,包括数据的准确性、时效性以及采集行为的合法合规性。从学情看,高一学生具有以下特点:一是生活经验丰富但知识零散,他们每天都在"生产"与"接触"数据——刷短视频、刷校园卡、运动手环计步——却很少意识到这些行为背后是数据采集的过程;二是动手能力分化明显,部分学生接触过Python甚至编写过简单爬虫代码,另一部分学生的计算机操作仅限于办公软件;三是伦理意识薄弱,大多数学生从未思考过"网页上的数据可不可以随便抓"这类问题。基于这些判断,本课的重点确定为数据采集方法的比较与选择,难点确定为网络爬虫基本原理的具象化理解以及数据采集中的伦理边界判断。三、教学目标的确立知识与技能目标:学生能够用自己的话解释数据采集的含义,列举至少三种数据采集方法并说明其适用场景;能够使用问卷工具设计并发放一份结构化调查问卷;能够说出网络爬虫"请求网页—解析内容—提取数据"的基本工作流程;能够判断常见采集场景中存在的规范与伦理问题。过程与方法目标:学生经历一个完整的小型数据采集项目,体验"需求分析—方法决策—工具实施—数据核验"的工作流程,初步形成根据数据特征、数据规模、数据时效性来选择采集方法的思维习惯。情感态度与价值观目标:学生在项目实施中体会到"垃圾进、垃圾出"的道理,建立数据质量意识;通过案例辨析认识到数据采集必须尊重他人隐私、遵守平台规则和法律规范,初步形成负责任的使用技术的态度。四、教学重点、难点与资源准备教学重点:三种主要数据采集方法(问卷采集、传感器采集、网络爬虫采集)的原理、特点与适用场景的比较分析。教学难点:网络爬虫工作机制的通俗化理解;采集方法选择背后的决策依据;数据采集伦理边界的把握。教学资源准备:多媒体网络机房,安装浏览器与必修一配套的Python环境,预装好requests库和可用于课堂演示的教学用网页(教师自建的包含课程表信息的静态页面,避免课上访问外部网站出现不可控情况);问卷工具账号若干;一个连接了光照传感器和温度传感器的演示装置(或祖国版开源硬件模拟器);学习任务单,包含三个递进任务和一份自我评价量规。五、教学过程设计整个教学过程用时两课时,共90分钟,分为五个环节推进。(一)情境导入:被"想当然"打败的决策(10分钟)上课伊始,教师向全班抛出一个具体情境:"学校总务处计划调整食堂高峰时段的窗口开放数量,需要先了解'哪个时段最拥挤'。有同学直接向总务主任报告'肯定是中午12点最挤,这还用调查?'主任反问他——'你凭什么?'"教师暂停三秒,请学生给主任一个令人信服的回答。学生通常会给出"看饭卡的消费记录""数人数""问同学"等答案。教师追问每一个答案背后的细节:"饭卡记录在哪里存着?谁去数?数多长时间?怎么问才能保证大家说的是真话?"学生对答过程中会逐渐意识到,任何答案都要落在"获取数据"这个动作上,而不同的获取方式难度、成本、可信度完全不同。教师顺势引出本课主题:"我们要解决的,就是这样一个前置于一切分析和计算的问题——数据到底怎么来。"板书课题"数据采集的方法和工具"。这个导入环节的意图,是让学生先产生认知上的饥饿感,再接受知识,避免开篇概念灌输造成的注意涣散。(二)概念辨析:什么才算"采集"(10分钟)教师不直接给出定义,而是呈现四张生活图片:医院体检时护士录入身高体重;十字路口的摄像头拍摄车流;手机应用统计用户每日屏幕使用时间;网购收货后客服来电回访满意度。学生以四人小组为单位讨论两个问题:这些场景有什么共同点?它们获取数据的方式有何不同?小组汇报后,教师归纳并板书核心概念:数据采集是通过一定的方式和手段获取数据的过程,其本质是把现实世界中分散的、以自然形态存在的信号,转化为可以被记录、传输和计算的信息。教师特别强调一个辨析点:"抄写别人的论文不是采集,那是抄袭;但把你观察到的、测量到的现象记录下来,这就是采集——采集的对象是现实世界,不是别人已经加工好的成果。"这句话为后面的伦理讨论埋下伏笔。随后教师出示方法分类框架:按参与方式分,有依赖人的感知与记录的人工采集,以及依靠设备和程序的自动采集。人工采集的典型工具有问卷、访谈提纲、观察记录表;自动采集的典型工具有传感器、日志文件、网络爬虫。这个框架仅作显性呈现,具体内涵留待任务中体悟,避免此处展开过细导致后面的实践环节时间被挤压。(三)任务一:人工采集的行动——设计"食堂拥挤度"问卷(20分钟)教师发放任务单,任务一要求各小组在15分钟内设计一份不少于5个题目的小型问卷,主题为"我校师生就餐时段与拥挤感受调查",并对题目类型作出要求:至少包含2个封闭式问题(单选、多选或量表)、1个开放式问题,且每个问题后面要标注"这道题想获得什么信息、属于什么类型的数据"。学生设计期间,教师巡视并针对常见问题给予点拨。巡视中重点纠正三类错误:一是诱导性问题,如"你是否也觉得12点的食堂挤得无法忍受",这样的问题得到的不是数据而是附和;二是含义不清的问题,如"你常去食堂吗"中"常"字没有边界,应当改为"每周大约几次";三是人口学信息贪多,重名、电话等既无用又侵犯隐私的字段要求删除,借机点出"采集最小必要数据"的原则。各组将问卷发布到问卷工具中,相邻小组互相试答。教师引导学生在试答后用一句话总结:"问卷回答的质量,取决于提问的质量——这被称为数据采集中的GIGO原则,垃圾进,垃圾出。"这句话用中文讲清,学生印象深刻。任务一的收尾处,教师提出一个过渡性问题:"如果我们想知道的不是感受,而是食堂门口每分钟通过多少人,问卷还有用吗?有没有不靠人一张一张填的办法?"学生自然说出"装个摄像头""用闸机刷卡记录"等想法,课堂由此滑入自动采集的领地。(四)任务二:自动采集的体验——传感器与爬虫(30分钟)此环节采用"演示引路、分组实操、异质分组中人人有事做"的组织方式。首先是传感器采集的演示与体验。教师用连通演示装置采集教室当前的光照强度和环境温度,数据以每两秒一条的频率出现在屏幕上。教师提问三个层层递进的问题:这些数据和人填写问卷得到的数据相比,优势在哪里?(客观、连续、不知疲倦、可长时间无人值守。)它们有没有局限?(只能测特定物理量,测不出"感受"与"态度";传感器本身存在精度误差。)生活中你还见过哪些传感器在默默采集数据?(学生列举手环、门禁、公交站客流量统计、快递柜等。)教师归纳:传感器采集擅长将物理世界的量转化为数字信号,是物联网时代数据洪流的第一水源。然后进入本课核心内容——网络爬虫。教师不先讲定义,而是播放一段精心设计的类比:"你想把图书馆里1000本书每一本的作者和出版年份抄到本子上。自己去翻,要翻三天。你请了一个力气大速度快、但完全不懂变通的机器人,你给它一张纸条写着'打开这本书—翻到版权页—把作者和年份抄下来—换下一本',它就能一夜抄完。这个机器人就是爬虫,这张纸条就是爬虫程序。"学生在这个类比中自然获得爬虫的逻辑骨架:访问、定位、提取、循环。教师随后用三行核心伪代码现场拆解真实爬虫的工作流,并在配套教学网页上运行课前准备好的示例程序:第一步,请求网页:程序向目标网页地址发送访问请求,拿到返回的网页源代码;第二步,解析定位:在源代码中找到目标数据所在的标签位置,如同在版权页找作者一栏;第三步,提取与存储:把找到的文字提取出来,按行写入本地文件,结构化保存。教师将屏幕上密密麻麻的网页源代码和提取出的整洁表格并排显示,学生直观看到"从杂乱到有序"的过程,理解爬虫本质上是"自动化的定位与复制"。接下进入实操环节,各组执行分层任务。基础层任务:运行教师提供的爬虫脚本,修改其中目标字段,从教学网页上把"课程名称"改成提取"任课教师",观察输出变化,目标是体会"改一行定位规则,采到的内容就不同"。提高层任务:教师给出另一结构不同的教学网页,学生参照示例修改定位标签完成新的采集。拓展层任务(供学有余力者):思考如果要采集的不是一页而是连续的十页,应在程序中加入什么?引导他们说出循环和页码拼接,为后续学习埋下伏笔。实操过程中教师重点关注两类情况:运行报错的学生,引导其读错误信息中的行号而非直接代劳;提前完成的学生,请其担任"小助教"帮扶邻组,转化课堂管理压力为同伴学习动力。(五)任务三:边界之辨——数据采集合规吗(15分钟)教师呈现三个案例组织快速辩论式辨析。案例一:某同学写爬虫抓取全校同学在某平台上的公开主页信息,包括姓名缩写、头像、作息发帖时间,用于"分析同学们的作息规律"。案例二:某软件每分钟高频访问某网站数万次导致该网站瘫痪。案例三:学校用摄像头统计每天进出图书馆的人数,仅记录数量不保存人脸。每组领取一个案例,用两分钟形成"合规/不合规/有条件合规"的判断与理由。汇报与交锋中,教师帮助学生提炼出三条边界:第一,法律边界——未经授权获取他人信息、突破技术限制抓取受保护内容,触碰的是法律红线;第二,规则边界——网站公开的访问约定(如允许抓取范围的说明文件、访问频率限制)应当被尊重;第三,伦理边界——即便技术上做得到,也要问一句"这样做会对当事人造成什么影响",摄像头案例之所以可以讨论,就在于它只采集"数量"这个去标识化的信息。教师用一句话收束本环节:"爬虫爬得快不快,考验的是技术;手往下按不按,考验的是人。学采集,先学敬畏。"这段话语速放缓,确保情感与价值观真正落地。(六)总结提升与作业布置(5分钟)教师带领学生回到开头的食堂问题,在黑板上完成一张决策对比表:若调查"拥挤感受"且样本人数大——用问卷;若调查"人流量"且需长期连续——用传感器或闸机日志;若需要"分析全市同类学校食堂营业时间"的公开网页信息——用爬虫。总结学生的选择逻辑:数据采集没有最好的方法,只有最合适的方法;合适与否,取决于数据类型、规模、时效、成本四条判据。作业分两项。必做项:以小组为单位完成"食堂拥挤度调查"的问卷实地发放与回收(一周内),下节课用所得数据开展统计分析。选做项:观察自己一天的生活,记录哪些行为在被各种设备"采集",写一段不超过300字的"我被采集的一天"。六、教学评价设计本课采用过程性评价为主的多元评价方式,评价嵌入任务本身。任务一的问卷用"问题是否清晰、类型是否恰当、是否遵循最小必要原则"三条标准由相邻组互评。任务二的实操评价采用量规,分为"能运行示例—能修改字段—能迁移到新页面—能解释原理"四个层次,学生自评与教师抽测结合。任务三的案例辨析侧重观点的证据支撑,不以立场对错而是以推理质量定高下。所有评价结果汇聚到学习档案袋,作为本单元过程性评价的一部分,为后续的"5.2.2数据的加工与表达"提供连续的学情依据。七、板书设计主板书居左,主题为"5.2.1数据采集的方法和工具",下方主干呈现三种方法:人工采集(问卷/访谈/观察)、传感器采集(物理量→数字信号)、网络爬虫(请求→解析→提取),支线标注选择判据"类型·规模·时效·成本"以及三条边界"法律·规则·伦理"。副板书居右,随课堂生成记录学生的典型答案与金句。板书随讲随写,结构即思维导图,学生抬头即见本课的知识骨架。八、教学反思预设与改进方向本课设计在三处可能遭遇实际困难,需要预案支撑。其一,学生操作水平落差大,若分层任务仍不能消化差距,可收缩爬

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论