大模型技术与应用课件 第3章 使用大模型_第1页
大模型技术与应用课件 第3章 使用大模型_第2页
大模型技术与应用课件 第3章 使用大模型_第3页
大模型技术与应用课件 第3章 使用大模型_第4页
大模型技术与应用课件 第3章 使用大模型_第5页
已阅读5页,还剩21页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

第3章

使用大模型CONTENTS目录01

大模型使用基础02

提示工程基础03

大模型进阶使用技巧04

大模型应用领域与案例05

大模型的控制与优化01大模型使用基础大模型使用的核心要点大模型的软件产品特性大模型属于软件产品,通常无详细说明书,且使用效果因技术和技巧差异显著,需使用者主动引导和训练。使用技巧的关键作用软件产品使用无绝对对错,但大模型因使用方法不同,输出结果质量可能天差地别,掌握技巧可大幅提升效果。训练大模型成为专家的价值通过引导和训练,可将大模型培养成特定领域的高水平专家,从而获得更精准、优质的结果,发挥其最大潜力。学习目标概述了解大模型使用方法掌握基础使用方法、进阶使用方法以及对大模型的控制方式,构建完整的使用知识体系。理解提示工程核心概念深入理解提示工程(Prompt工程)的原理与作用,明确其在引导大模型输出中的关键地位。应用所学方法解决实际问题能够将本章介绍的提示工程、零样本/少样本提示、思维链等方法应用于具体场景,提升大模型使用效能。02提示工程基础提示工程的定义与价值

提示工程的核心概念提示工程(Prompt)是与大模型沟通的“语言”,即通过设计精准的输入文本,引导大模型生成符合预期的输出。其本质是让使用者用大模型能理解的方式下达指令,充分激发模型潜力。

新兴职业:Prompt工程师随着大模型技术发展,提示工程已催生专门职业——Prompt工程师。他们擅长设计高效提示词,通过优化输入提升模型输出质量,是连接用户需求与模型能力的关键桥梁。

提示工程的核心价值优质Prompt可实现“事半功倍”的效果:既能显著提升大模型任务完成质量,又能通过封装特定Prompt,将通用大模型快速转化为垂直领域的功能卡或专业助手,降低行业应用门槛。提示词三段论结构角色:赋予模型身份定位明确大模型需扮演的角色,为其设定专业背景或身份特征。例如:“你是一位有20年教龄的资深人工智能教师”,使模型输出贴合角色专业视角。技能:界定角色能力范围描述该角色应具备的专业技能或知识储备。例如:“熟悉机器学习及深度学习的相关技术及实现,掌握大模型开发的各种技术,擅长调参、微调,解决模型过拟合和欠拟合等问题”。任务:明确具体目标需求清晰下达模型需完成的任务指令。例如:“编写一个大模型案例,教会学生从零开始搭建属于自己的大模型”。通过角色、技能、任务三段论,构建完整提示词,最大化模型使用效果。零样本提示框架

零样本提示的基本构成要素零样本提示框架包含五大核心要素:角色(模型扮演身份)、指令(任务描述)、上下文(辅助信息)、输入数据(问题或内容)、输出指示(结果格式要求),适用于模型未经过特定任务训练的场景。

只提供指令形式直接向模型下达任务指令,无需额外信息。例如:“请总结以下文本的核心观点”,依赖模型对通用任务的理解能力,适用于简单明确的需求场景。

上下文+指令+输出指示形式通过补充上下文信息、明确指令及输出格式,提升模型响应精准度。例如:“(上下文:某公司2024年营收1000万元,成本600万元)指令:计算净利润。输出指示:以‘净利润:XX万元’格式呈现”。

角色+多要素组合形式融合角色、上下文、指令、问题及输出指示,构建复杂提示。例如:“(角色:财务分析师)(上下文:某公司2024年数据如下...)(指令:分析盈利状况)(问题:净利润率较去年下降的原因?)(输出指示:分点列出关键因素)”。少样本提示与思维链01少样本提示的核心特点少样本提示(fewshot)通过提供少量示例样本,让大模型快速学习任务模式,提升回答精确性。适用于模型对新任务不熟悉,但可通过示例迁移学习的场景,减少对大规模标注数据的依赖。02思维链提示的作用机制思维链提示引导大模型分步展示推理过程,将复杂逻辑问题拆解为连贯步骤,帮助模型理清思路,减少直接输出错误答案的概率。尤其适用于数学推理、逻辑分析等需要多步推导的任务。03思维链的典型触发方式除通过少样本示例引导推理外,可直接使用提示语“请一步步思考”触发思维链机制。例如,在数学问题中加入该提示,模型会先列出计算步骤,再给出最终答案,显著提升复杂问题解决的准确性。04少样本与思维链的协同价值少样本提示提供任务范例,思维链提示强化推理逻辑,二者结合可应对更复杂场景。例如,通过“示例样本+分步推理要求”,大模型能快速掌握专业领域问题的解决范式,输出既精准又可解释的结果。03大模型进阶使用技巧ReAct框架:推理与行动的融合

01ReAct核心逻辑:推理与行动的协同ReAct框架通过“推理(Reason)+行动(Action)”打破纯推理与外部信息的壁垒,形成“推理—行动—反馈—再推理”闭环,解决传统思维链“闭门造车”式推理的局限性,让模型像人类一样“边想边做”。

02复杂问题解决示例:动态信息查询以“2025年国内已开源的万亿参数大模型中支持多模态交互且中文编程基准测试前三”为例,ReAct先推理需获取2025年模型列表及测试排名,再调用网络检索工具获取阿里云通义千问Qwen3-Max、蚂蚁百灵Ling-1T、KimiK2-Instruct等事实信息,最终匹配条件输出答案。

03典型应用场景:职场与学术任务智能客服处理“2025年新款家电联保政策”时,先推理需查询品牌售后规则,再调用官网知识库;学术研究撰写“2024—2025大模型产业趋势报告”时,通过检索行业白皮书补充实时数据,确保报告准确性。Embedding技术与本地知识库构建Embedding原理:文本向量化转换

Embedding将文本转化为具备数学意义的向量,通过计算向量间相关性实现语义理解,解决大模型对企业/个人私有信息库的知识欠缺问题,避免API调用token限制和高成本二次训练。本地知识库构建四步流程

1.文本整理分块并向量化,存储于向量数据库;2.用户输入文本向量化后在数据库进行相似性匹配,获取topN文本块;3.将匹配文本融入Prompt输入大模型;4.大模型结合语义理解生成精准答案。核心价值:私有知识高效利用

通过Embedding技术,企业可将内部文档、个人可将私有信息转化为向量数据,使大模型在不暴露原始数据的前提下,基于本地知识库回答专业问题,实现个性化、安全化知识服务。少样本提示与微调的区别

少样本提示:外部指令的临时模仿少样本提示通过提供少量示例、明确格式要求,引导大模型“临时模仿”特定任务输出,无需改动模型参数,适用于快速适配简单场景,如格式统一的文本生成、分类任务。

微调(Fine-Tuning):内部参数的真正学会微调以预训练模型为基座,投喂少量特定数据集调整参数,使模型“真正学会”垂直场景规则,保留基础能力的同时形成“专项技能”,如中译英模型固定输出英文,成本低于重训练且精准度更高。

应用场景选择指南少样本提示适合短期、轻量、多变的任务需求;微调适用于垂直领域长期应用,如医疗诊断、法律合同审查等对精准度和稳定性要求高的场景,需根据任务复杂度、数据量及成本综合选择。04大模型应用领域与案例自然语言处理领域代表模型

GPT系列(OpenAI)代表版本有GPT-3(1750亿参数)、GPT-4、GPT-4o、GPT-5。基于自回归生成式架构,以流畅生成能力著称,支持多轮对话、创意写作等复杂任务,GPT-4及后续版本加入多模态能力,广泛应用于聊天助手、内容创作等场景。

Llama系列(Meta)代表版本包括Llama2(70亿~700亿参数)、Llama3(8B-405B参数)、Llama4(10亿~2万亿参数)。开源且支持商用,兼顾性能与部署灵活性,衍生出CodeLlama等细分模型,推动开源AI生态发展。

文心大模型(百度)代表版本ERNIE3.0(2600亿参数)、文心一言4.0/4.5。国内首个知识增强大模型,融入知识图谱实现“理解+生成”双模协同,突出中文语义理解优势,在医疗诊断等知识密集型任务中表现突出。

通义千问(阿里云)代表版本Qwen2.5(70亿~720亿参数)、Qwen3-Max(1万亿参数)。聚焦中文场景与产业落地,开源模型覆盖全参数梯度,支持长上下文窗口,在数学推理、代码生成等方面表现优异。自然语言处理领域代表模型

Claude系列(Anthropic)代表版本Claude2、Claude3(Opus/Sonnet/Haiku)。以“安全性”和“长文本处理”为核心优势,支持最长10万以上token的上下文窗口,适合企业级文档处理、法律合同分析等场景。多模态大模型的突破

Gemini系列(Google)代表版本Gemini1.5、Gemini2.5Pro。Google首款真正意义上的多模态大模型,原生支持文本、图像、语音等多种输入,上下文窗口最长达100万token,在跨模态推理中表现优异。

DALL·E系列(OpenAI)代表版本DALL·E2、DALL·E3。专注“文本到图像”生成,能精准理解文字描述的创意需求,生成高质量图像,DALL·E3与GPT-4深度集成,广泛应用于设计、广告等领域。

Midjourney以“图像生成的艺术质感”著称,基于扩散模型架构,支持通过文本提示词生成超高清、富有艺术感的图像,涵盖多种风格,是设计师、艺术家的常用工具。

文心一格(百度)国内首个“文本—图像”生成大模型,融入中文美学元素,支持生成符合东方审美的图像,还支持“图像—图像”风格转换、3D模型生成等功能,落地于广告设计等场景。垂直领域大模型的深度适配

医疗领域如Med-PaLM(Google)、ChatGLM-Med(清华大学),经海量医疗文献、病历数据微调,支持疾病诊断咨询、病历结构化提取等任务,Med-PaLM2通过美国医师执照考试,已在基层医院等试点应用。

法律领域如LawGPT(华东政法大学)、DoNotPay,专注法律文本处理,支持合同审查、法律条文检索等任务,LawGPT基于中文法律语料微调,能解答常见法律问题,DoNotPay可帮助生成法律文书。

工业领域如盘古大模型(华为),为工业场景量身打造,分气象、矿山、电力等细分版本,盘古气象大模型能实现全球秒级气象预报,矿山版可检测设备故障,提升生产效率与安全性。

教育领域如松鼠AI大模型、科大讯飞星火认知大模型(教育版),适配教学场景,支持个性化习题生成、知识点讲解等任务,能根据学生学习数据定位薄弱环节,生成定制化学习方案。05大模型的控制与优化Prompt工程的应用步骤明确任务目标清晰界定模型需执行的任务类型,如文本生成、问答、翻译等,确保目标具体可量化,为后续提示设计提供方向。设计精准提示构建包含角色、技能、任务的三段式提示,确保信息完整、指令明确,避免模糊表述,例如“作为20年教龄AI教师,用通俗语言解释机器学习原理”。测试与迭代优化通过多次测试调整提示,观察模型输出是否符合预期,针对偏差优化措辞或补充上下文,直至达到理想效果,此过程需结合模型特性动态调整。模型二次训练与Fine-Tuning二次训练核心价值基于预训练模型,通过少量特定领域数据微调,实现任务定制与领域适配,平衡成本与性能,如将通用模型优化为专业翻译工具。Fine-Tuning实施流程包括数据标注(如情感分析数据集)、参数初始化(复用预训练权重)、损失函数设计(如交叉熵损失),以及多轮训练调优,提升特定任务精度。情感分析应用示例以GPT-3为基座,使用标注的评论文本(含正/负面标签)微调,通过控制损失函数使模型学会情感分类,最终部署用于实时评论分析。基于规则的前后处理策略

前处理:数据预处理对输入文本进行清洗(去噪声、纠错)、关键信息提取(如用户问题中的实体)、格式转换(如标准化对话模板),为模型提供高质量输入。

后处理:结果优化对模型输出进行过滤(敏感内容筛查)、长度调整(满足字数限制)、格式规整(如结构化摘要),确保结果符合应用场景需求。

对话系统应用案例前处理纠正用户拼写错误并提取意图,后处理对生成回复排序去重,提升对话流畅度与准确性,增强用户交互体验。大模型的边界与限制

知识与逻辑局限存在“幻觉”现象(编造虚假信息),逻辑推理能力弱,尤其在数学问题和复杂逻辑任务中依赖表面模式匹配,缺乏深层理解。

性能与交互限制输入输出受token长度限制,长对话易丢失上下文;响应速度慢,实时性差,且输出稳定性不足,相同输入可能产生不同结果。

应对策略建议通过外部工具检索补充实时

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论