人工入门智能基础 3_第1页
人工入门智能基础 3_第2页
人工入门智能基础 3_第3页
人工入门智能基础 3_第4页
人工入门智能基础 3_第5页
已阅读5页,还剩22页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

第8章大模型与人工智能

本章目录01大模型的概念、特点与发展02大模型训练、部署与挑战03大模型在各领域的实际应用04大模型的提示词使用教学05大模型的未来发展趋势与挑战1大模型的概念、特点与发展01大模型的概念、特点与发展02大模型训练、部署与挑战03大模型在各领域的实际应用04大模型的提示词使用教学05大模型的未来发展趋势与挑战1大模型的概念、特点与发展概念与特点所谓“大模型”,是指参数量极其庞大的人工智能模型。参数是模型在训练中“学会”的信息,比如一段文字中哪些词常一起出现、某张图片中有哪些形状是常见的物体等。传统的人工智能模型可能只有几十万到几百万个参数,而大模型的参数量动辄达到数十亿、甚至万亿级别。模型类型参数量级代表模型应用场景传统机器学习千-万级线性回归、决策树简单分类、预测早期神经网络万-十万级多层感知机图像识别、语音识别深度学习模型百万-千万级ResNet、LSTM复杂视觉、语言任务大型语言模型十亿-万亿级GPT-3/4、Claude通用人工智能任务1大模型的概念、特点与发展发展历程语言模型从20世纪80年代基于统计学习的自然语言处理和机器学习的探索时期到现在深度学习的兴起,发展到大语言模型经历了以下四个阶段:语言模型旨在对人类语言的内在规律进行建模,从而准确预测词序列中未来(或缺失)词或词元(Token)的概率1大模型的概念、特点与发展对比维度传统AI模型大模型任务范围单一专门任务多任务通用能力学习方式需要大量标注数据可从无标注数据学习适应性难以迁移到新任务可快速适应新领域交互方式固定输入输出格式自然语言对话部署成本低高开发周期长(需要专门训练)短(可直接使用或微调)传统AI模型与大模型的能力对比为了更好地理解大模型的“大”,我们可以做一个简单的比喻:如果说传统的小模型是一辆能完成某项任务的自行车,那么大模型就是一辆自动驾驶的多功能智能巴士。它不仅可以按照用户的目的地行驶,还能在途中识别路牌、调节车内温度、根据乘客的情绪播放不同的音乐。这种“全能性”,正是大模型区别于传统模型的关键所在。大模型的发展也反映了人工智能领域的一种哲学转向:从“精雕细琢的专用工具”,迈向“万能平台级系统”。这背后蕴含着一种“数据驱动的智能观”——只要有足够多的数据和足够强的计算能力,智能的边界就可以不断延展。这一理念推动了整个AI领域的创新思维模式变革。2大模型训练、部署与挑战01大模型的概念、特点与发展02大模型训练、部署与挑战03大模型在各领域的实际应用04大模型的提示词使用教学05大模型的未来发展趋势与挑战2大模型训练、部署与挑战

大模型的训练过程大模型的训练堪称一场

“数据与算力的盛宴”,需要为其提供海量的学习素材,搭建高效的学习环境,并通过反复练习让其掌握知识规律。大模型的学习素材几乎涵盖了人类社会积累的各类公开信息,从百科全书、新闻报道、学术论文到社交媒体对话、编程代码、文学作品,甚至包括多语言的文本资料,这些数据共同构成了一个横跨多个领域的“知识海洋”。模型名称参数量训练时间GPU使用量估算成本(美元)能耗(MWh)GPT-31750亿约1个月1万块V100460万1287PaLM5400亿约2个月6144块TPUv4900万2500GPT-4约1万亿约3个月2.5万块A1006300万5000+主要大模型训练成本估算(注:以上数据为业界估算)2大模型训练、部署与挑战原始数据并非可以直接使用,工程师们要对数据进行严格的清洗与筛选。这个过程包括剔除重复内容、低质量文本和无意义的乱码,过滤掉包含偏见、暴力、歧视等有害信息,同时还要对数据格式进行统一处理,比如将不同编码的文本转换为统一格式,处理特殊符号等,让数据更“易读”。更重要的是,为了保护用户隐私,所有涉及个人信息的数据都会经过匿名化处理。数据准备就绪后,就进入了核心的训练阶段,这个阶段让模型在海量数据掌握语言、图像等信息的内在规律。2大模型训练、部署与挑战大模型的部署方式部署是模型投入使用的必经之路,它将训练好的模型从计算集群带到实际应用场景,为用户提供服务。将模型部署在科技公司的远程服务器上,用户通过网络访问。这是目前大众最常用的方式,如ChatGPT。云平台部署将模型安装在个人电脑或企业自有服务器上,所有计算和数据处理都在本地完成,私密性强。本地部署无需硬件弹性计算即时更新保护隐私离线可用响应迅速缺点:依赖网络隐私风险成本较高缺点:硬件投入

技术运维

资源占用2大模型训练、部署与挑战大模型面临的挑战可解释性大模型幻觉计算资源多语言支持社会伦理实时信息数据质量安全和隐私超长上下文性能和稳定性3大模型在各领域的实际应用01大模型的概念、特点与发展02大模型训练、部署与挑战03大模型在各领域的实际应用04大模型的提示词使用教学05大模型的未来发展趋势与挑战3大模型在各领域的实际应用当我们谈论大模型对社会的影响时,最直观也最能激发想象力的问题就是:“它到底能做什么?”从科研论文、产品发布会到大众媒体的报道中,我们看到的更多是技术名词和抽象能力的描述,比如“大语言模型”、“跨模态学习”、“代码自动生成”等等。但对普通读者来说,真正重要的是这些技术能否切实改善我们的生活、工作与学习体验。只有当一项技术走出实验室,真正改变了普通人的行为方式,它才称得上“落地生根”。本节将带你全面了解大模型在各个实际领域的应用,特别关注它在教育、医疗、写作、艺术、办公等方面的创新价值。应用领域具体应用代表产品/服务应用效果教育智能答疑、作业批改KhanAcademyAI、作业帮24小时在线辅导,个性化学习医疗病历分析、诊断辅助IBMWatsonHealth、科大讯飞医疗提高诊断准确率,减少误诊写作内容创作、文案生成Jasper、Copy.ai、秘塔写作猫提升写作效率3-5倍创作图片,视频生成Sora、StableVirtualCamera、谷歌Flow一键生成描述的图片或视频编程代码生成、调试辅助GitHubCopilot、CodeT5编程效率提升30-50%客服智能对话、问题解答阿里小蜜、腾讯智能客服解决80%常见问题,24小时服务翻译多语言翻译、本地化DeepL、百度翻译接近人工翻译质量3大模型在各领域的实际应用大模型正成为教育领域的“智能教师”与“私人助教”,从备课、教学到个性化辅导,全方位提升教与学的效率与质量。教师输入教学主题,大模型可快速生成符合课标的教案、课件与课堂练习题,极大提升备课效率。智能备课1根据学生不同水平,大模型能提供差异化的教学策略和学习材料,辅助教师实现精准教学。分层教学建议2围绕特定知识点,大模型能精准筛选并推荐相关的动画、视频、阅读材料,丰富教学内容。教学资源推荐3定制学习计划分析学生学习数据,为其量身打造专属的词汇、语法等学习计划,靶向提升薄弱环节。实时口语陪练模拟真实对话场景,扮演口语伙伴,并从语音、语法、流利度等维度给予即时反馈与纠正。智能答疑解惑24小时在线解答学生疑问,提供多种解题思路,成为学生随时可求助的“智能学霸”。123学生教师3大模型在各领域的实际应用大模型在医疗领域扮演着“诊断助手”与“研发加速器”的关键角色,助力医生提升诊断准确性,并加速新药研发进程。病历信息整合01快速整合患者症状、检查报告等多源信息,为医生提供全面的诊疗视图。辅助诊断建议02在瞬间给出多种可能的诊断建议,并提供概率评估与相似病例参考,减少误诊漏诊。诊疗方案推荐03基于最新医学知识和病例数据,为复杂病例推荐个性化的治疗方案参考。提升诊疗效率与准确性3大模型在各领域的实际应用从文字到图像,再到视频,大模型正颠覆传统内容创作范式,成为创作者的灵感引擎与高效生产工具。从灵感激发到高效成文01输入主题,大模型可快速生成数十个不同角度的创意构思,帮助作者突破思维瓶颈。灵感激发02根据主题和要求,自动生成逻辑清晰的文章大纲,构建内容框架。大纲生成03根据大纲,自动撰写文章初稿,极大提升写作效率。内容填充04将已有文本转换为学术、轻松、幽默等不同风格,以适应不同受众和平台。风格润色4大模型的提示词使用教学01大模型的概念、特点与发展02大模型训练、部署与挑战03大模型在各领域的实际应用04大模型的提示词使用教学05大模型的未来发展趋势与挑战提示词提示词(Prompt)是人工智能模型与用户之间交互的核心工具,它通过自然语言指令引导模型生成符合预期的输出。提示词的作用不仅在于传达任务需求,还在于影响模型的输出质量、结构和风格。4大模型的提示词使用教学4大模型的提示词使用教学构成要素02明确告诉模型需要完成的任务指令(Instruction)04模型处理的具体内容,如文本、图像或数据输入数据(Input)06通过提供少量示例,帮助模型理解任务的输出风格和逻辑示例(Few-ShotExamples)01为大语言模型指定特定角色或身份,以引导其生成符合预期的回答角色(Role)03提供背景信息,帮助模型理解任务的语境上下文(Context)05指定输出的结构或格式期望输出格式(OutputFormat)4大模型的提示词使用教学主要方法零样本提示(Zero-shotPrompting)直接向模型下达任务指令,不提供任何示例。适用于目标明确、模型已具备相关知识的场景。将以下中文句子翻译成英文:“人工智能正在改变世界。”少样本提示(Few-shotPrompting)提供少量任务示例(通常1-5个),帮助模型快速理解任务模式。示例相当于“教学样本”,可显著提升模型在专业或复杂任务中的表现。例1:输入“开心”→

输出“(*^_^*)”

例2:输入“悲伤”→

输出“>﹏<”

请为“惊讶”生成表情符号:4大模型的提示词使用教学链式思维提示(ChainofThought,CoT)要求模型分步展示推理过程,而非直接输出最终答案。通过强制拆解问题逻辑,提升复杂问题的解决能力。某书店第一周售出120本书,第二周销量增加20%,第三周比第二周少卖10%。问第三周售出多少本书?请逐步计算。自我一致(Self-Consistency)针对同一问题要求模型生成多种解法或答案,通过交叉验证降低随机错误。适用于数学证明、逻辑推理等容错率低的场景。用三种不同方法验证“15是否为质数”,并对比结果检索增强生成(Retrieval-AugmentedGeneration,RAG)通过检索外部知识库来增强模型的生成能力。例如,在问答任务中,模型可以先检索相关知识,再生成更准确的答案。4大模型的提示词使用教学实用技巧1.构建清晰的提示词框架,核心在于精准表述任务需求。清晰阐述需要解决的问题或达成的目标(问题/任务),明确告知模型需要执行的具体操作(如生成攻略、编写代码、优化文章),并补充必要的约束条件(如输出格式、长度限制、内容范围限定)。4大模型的提示词使用教学实用技巧2.采用结构化拆分方法可显著提升效率与灵活性。将提示词系统性地拆分为四个模块:角色设定、问题描述、目标说明、具体要求。这种结构不仅便于提示词的管理、维护和动态组合,增强其适应性,还为处理复杂任务或多模型协作提供了稳定有效的框架。3.善用“角色设定”来激活模型能力。将“角色”(如“资深编辑”、“数据分析师”)视为模型的“能力模块”。通过设定角色,能够快速激活模型相应的知识库和能力集,避免对任务细节和所需能力进行冗长描述,帮助模型更准确地理解上下文并调用相关能力。4.务必清晰补充具体要求以规范输出。在描述任务后,明确提出对模型输出的期望,包括应做和不应做的内容,这对结果准确性至关重要。常见要求类型包括字数/长度限制、输出结构(大纲、列表等)、输出格式(JSON、Markdown等)以及特定内容的包含或排除。要注意的是,建议将具体要求置于

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论