高中信息技术选修3信息检索工具的工作原理教学设计_第1页
高中信息技术选修3信息检索工具的工作原理教学设计_第2页
高中信息技术选修3信息检索工具的工作原理教学设计_第3页
高中信息技术选修3信息检索工具的工作原理教学设计_第4页
高中信息技术选修3信息检索工具的工作原理教学设计_第5页
已阅读5页,还剩5页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

高中信息技术选修3信息检索工具的工作原理教学设计【教材分析】本课选自教科版高中信息技术选修3《网络技术应用》第一章第三节第二课时,主题为信息检索工具的工作原理。前一课时学生已经认识了目录检索与全文检索两类检索工具,能够熟练使用搜索引擎获取信息,但对检索工具"背后发生了什么"缺乏认知。本课承上启下:向上承接网络基础知识与信息获取方法,向下为后续数据库管理、信息系统开发等模块奠定认知基础。教材内容涉及搜索引擎的三个核心组成部分——搜索器、索引器、检索器,以及两个关键操作——建立索引数据库和响应用户查询,概念抽象、流程隐蔽,是本章的教学重点,也是学生易生畏难情绪的难点。【学情分析】授课对象为高中年级选修本模块的学生。他们大多是搜索引擎的深度使用者,每天检索信息,但认知停留在"输入关键词、点击搜索、浏览结果"的操作层面。一份课前问卷显示,超过八成学生认为"搜索引擎是实时在互联网上查找信息的",这正是本课最需纠正的前概念偏差。学生逻辑思维逐步成熟,具备一定的类比迁移与流程分析能力,喜欢有挑战性的探究任务,对"揭秘"式学习内容兴趣浓厚。教学中应利用其使用经验作为认知起点,通过制造认知冲突、搭建生活类比、组织模拟体验三个层次,帮助学生完成从"会用"到"懂原理"的跨越。【教学目标】信息意识方面,学生能意识到搜索引擎并非万能的实时查找者,理解检索结果受索引数据库的时效性、覆盖范围制约,从而对检索结果保持审视态度,形成合理选择检索工具与调整检索策略的意识。计算思维方面,学生能够描述全文搜索引擎"搜索器采集—索引器加工—检索器响应"的工作流程,能用流程图表示自动信息搜集与索引建立的基本过程,初步理解倒排索引"以词找文"的思想,体会分而治之与预处理思想在高效率信息处理中的价值。数字化学习与创新方面,学生能通过模拟倒排索引建立的小组活动,亲身体验数据组织的逻辑,并能将流程分析方法迁移到对其他信息系统工作原理的探究中。信息社会责任方面,学生能理解网页排序规则对信息可见性的影响,理性看待商业搜索引擎的排名结果,形成对"被排序的信息世界"的基本判断力。【教学重点与难点】教学重点:全文搜索引擎三类核心部件的功能与协同工作流程;索引数据库的建立与作用。教学难点:倒排索引的组织方式及其高效性原理;纠正"实时搜索"的错误前概念。【教学策略与方法】本课采用问题驱动与体验学习相结合的设计。以"搜索引擎是一瞬间就搜遍整个互联网的吗"作为主问题贯穿全程,用"图书馆找书"类比倒排索引,用"角色扮演"模拟三大部件协同工作,辅以教师精讲、视频演示与流程图归纳。教学环境为网络机房,学生每人一机,全班分为六个探究小组。课前准备两组网页文档卡片、倒排索引建立任务单、课堂评价量规。【教学过程】一、情境导入:制造认知冲突(约6分钟)上课伊始,教师打开搜索引擎,现场输入"人工智能"一词,请学生观察检索结果页面。屏幕显示"找到相关结果约数千万条,用时0.4秒"。教师停下手,向全班抛出主问题:"互联网上网页数以百亿计,搜索引擎凭什么在不到一秒的时间里,把几千万条结果找齐并摆在你面前?它真的是在这一瞬间跑遍整个互联网的吗?"学生自由发言。多数学生认为"是实时查找的",也有学生凭直觉说"太快了,不可能"。教师不急于评判,而是追问:"如果是实时查找,按搜索引擎每秒能抓取的网页数量估算,搜完整个互联网需要多久?请小组估算一下。"学生以"假设互联网有2000亿个页面,一台服务器每秒能抓取1000个页面"为条件进行估算,得出的结果以"年"计。巨大的时间与不到一秒的现实形成强烈冲突,学生的原有认知被动摇。教师顺势点题:"真相是,搜索引擎在我们输入关键词之前,就把大量的准备工作做完了。今天我们就要揭开它的工作内幕——信息检索工具是怎样工作的。"板书课题,明确本课学习任务:弄清三个部件、两次关键操作、一个核心数据结构。二、类比建构:图书馆里的倒排思想(约10分钟)教师引导:"要解决'快'的问题,人类社会其实早有一个成熟的方案。假设你去图书馆找一本包含'热带雨林'知识的书,你有两种办法。"办法一:从第一个书架开始,一本一本翻阅所有图书,翻到含有"热带雨林"内容的就记下来。学生立刻反应:这太慢了。教师指出,这就是原始的全文扫描思路,逐页比对,理论上可行,时间上不可行。办法二:先查书目索引卡片或电子检索系统,输入"热带雨林",系统直接告知哪些书在哪些架位。教师追问:"卡片为什么能让查找变快?"学生讨论后认识到:因为图书管理员提前把每本书的内容做了分析,建立了"主题词—对应图书"的对照表,查找时只需要查这张提前做好的表,而不是查所有书。教师揭示核心概念:这张"从词语指向文档"的表,在搜索引擎中叫倒排索引。之所以叫"倒排",是因为它与正常的阅读顺序相反——正常是"文档里有词",倒排是"词对应着文档"。教师在黑板上用三组短文档现场演示建立倒排表:文档1:信息技术改变社会文档2:信息技术课很有趣文档3:社会发展与健康经过分词与整理,得到"词语→出现的文档编号"的列表:信息技术→文档1、文档2;社会→文档1、文档3;……学生清楚看到,当用户查询"信息技术"时,检索器只需查这张表,答案第1、2号文档立刻浮现,无需打开任何一篇原文。此时课初的谜题已解大半:搜索引擎的快速,来自"事前建好索引,查时只查索引"。教师强调这就是预处理思想的威力——把时间花在平时,换取响应时的快捷。三、精讲流程:三大部件各司其职(约12分钟)教师播放一段两分钟的动画短片,展示搜索引擎内部的工作景象,随后结合投影片逐步讲解全文搜索引擎的三个核心部件。第一个部件是搜索器,又称网络蜘蛛或网络爬虫。它的职责是在互联网上自动沿着网页之间的超链接不断爬行,像蜘蛛在网上攀爬一样,把抓到的网页内容源源不断地取回来。它是搜索引擎的"眼睛和手脚",负责信息采集。教师补充:爬虫有严格的运行规则,包括遵守网站的访问协议、控制抓取频率、识别链接结构,抓取的不是全部互联网,这就解释了为什么不同搜索引擎的结果不同、新网页可能暂时搜不到。第二个部件是索引器。抓回来的网页原文杂乱无章,索引器负责对每个网页进行分析:去掉网页标签等无关代码,进行分词处理(把连续文本切分成一个个词语,对中文而言这一步尤其复杂),统计词语出现的位置与频率,然后按照刚才学过的倒排索引方式,建立"词语→网页"的巨型索引数据库。它是搜索引擎的"档案管理员"。教师在此呼应第一课时的目录检索:目录式检索依靠人工分类编辑,而全文检索的这一步完全靠程序自动完成,这是两者本质区别之一。第三个部件是检索器。当用户在搜索框输入关键词,检索器开始工作:先对用户输入的内容做分词处理,再到索引数据库中查找匹配的网页列表,然后根据网页与关键词的相关程度以及网页本身的质量指标,对所有匹配结果进行排序,最后以网页摘要加链接的形式呈现给用户。它是搜索引擎的"前台服务员"。教师用一个形象的比喻收束讲解:搜索器是采购员,负责把原料(网页)运回仓库;索引器是仓库管理员,把原料分门别类建好台账;检索器是售货员,顾客来了按台账迅速取货。三者流水线式协同,才有了"0.4秒"的奇迹。讲解后,教师请学生对照黑板,填写流程图:网络蜘蛛抓取网页→()建立索引数据库→用户输入关键词→检索器在()中查找→排序并返回结果。学生填写完毕,教师强调一个易错点:检索器查找的是"索引数据库",而不是"互联网",请全体学生把这句话齐读一遍,以固化正确认知。四、小组体验:亲手建一张倒排索引(约12分钟)各组领取材料袋,内有六篇模拟"网页"的短文卡片,内容涉及校园生活、科技热点等话题。任务分三步:第一步,分词。小组成员将每篇短文切分成若干关键词,写在便利贴上。学生发现中文分词并不简单,比如"南京市长江大桥"可以切出不同结果,教师借此点拨:分词质量直接影响检索质量,真正的搜索引擎为此投入了大量算法研究。第二步,建立索引。小组把相同词语的便利贴归类,填写"关键词→出现在哪几篇文档"的对照表,并在表后为每个关键词标注词频。教师巡视,对操作困难的小组给予提示,对各组的索引表逐一核对。第三步,模拟检索。教师现场扮演"用户",说出查询词"校园活动",各组检索员只许查自己建的索引表,在五秒内答出匹配的文档编号,并按词频之和给出排序。各组比速度、比准确。成功响应的小组体验到"查表"的高效:六篇文档根本不需要逐篇翻阅。活动结束,教师组织反思提问:"如果文档不是六篇,而是六十亿篇,你的想法是什么?"学生回答:必须靠程序自动完成,必须依靠庞大的服务器集群。教师点拨分而治之思想:搜索引擎把互联网划分为无数分片,由成千上万台服务器并行抓取与索引,这是人与人之间的分工在互联网时代的工程化放大。五、深化拓展:排名背后的学问与社会审视(约5分钟)教师抛出新问题:"同一个关键词可能匹配出几千万个网页,排在前面的凭什么排在前面?"学生结合体验活动中"按词频排序"的做法,提出内容相关性因素。教师补充:现代搜索引擎还会评估网页的权威性——一个重要依据是有多少高质量网页链接指向它,这与人推荐人的道理相通;同时商业因素、时效性也参与排序。由此引出信息社会责任教育:排名靠前不等于信息可靠,竞价排名、流量操纵都可能影响我们看到的顺序。教师提醒学生,今后检索信息要养成翻看多页结果、交叉验证来源的习惯,要意识到自己看到的互联网是经过算法筛选过的互联网。这一环节将技术原理自然延伸为媒介素养教育,紧扣课程育人目标。六、总结梳理:一句话说清原理(约3分钟)教师请学生尝试用一句话回答课初的主问题。学生代表发言:"搜索引擎提前用网络蜘蛛抓取网页并用索引器建成倒排索引数据库,用户查询时检索器只在索引库里匹配并排序,所以无比之快。"教师组织全班按"因为……所以……"的句式共同复述一遍完整流程,投影片同步呈现本课结构图:三个部件、两次操作、一个索引、一条流水线。七、课堂检测:即时反馈(约4分钟)完成三道在线测评题。其一,判断:用户提交查询后,搜索引擎的蜘蛛立即出发到互联网上查找。学生作答,正确率高的选项得到解析确认。其二,填空:索引器建立的是____索引,它建立的是从____到____的对照关系。其三,简答:为什么有时新发布的网页短时间内搜不到?用本课原理解释。检测数据实时汇总,教师针对错误集中的题目现场再讲三十秒,确保教学目标当堂达成。【板书设计】主板书自上而下呈现流水线:搜索器(网络蜘蛛)→抓取网页→索引器→分词、建倒排索引→索引数据库→检索器→匹配、排序→搜索结果。副板书左上角写下主问题"0.4秒的秘密",右下角保留倒排索引示例表。整版简洁呈线性,直观呼应"流水线"这一教学意象。【作业设计】基础作业:绘制一张"全文搜索引擎工作流程图",要求标注三大部件的功能与索引数据库的位置,下节课前拍照提交。拓展作业(二选一):其一,用同一关键词分别在两个不同的搜索引擎中检索,对比前十条结果的异同,尝试用本课所学解释差异产生的原因,写三百字分析;其二,查找资料了解"网络蜘蛛应当遵守的抓取规则",思考技术行为与网站权益、个人隐私之间的关系,准备下节课两分钟分享。【评价设计】课堂评价采用过程性评价与结果性评价结合。过程性评价观察小组活动中分词的规范性、索引表的正确性与模拟检索的响应速度,依据预制的三级量规即时记录;结果性评价依托当堂检测数据与作业质量。教师特别关注两类学生:原理理解到位但表达偏弱的学生,在复述环节给予句式支架;操作积极但急于完成的小组,引导其核

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

最新文档

评论

0/150

提交评论