2026云栖大会资料-「Agent 工程化」方向-15个Agent组成研发小队:多智能体协作的端到端研发体系 基于 AgentCore 的 MultiAgent Dev Team 与 AgentLoop调优实践_第1页
2026云栖大会资料-「Agent 工程化」方向-15个Agent组成研发小队:多智能体协作的端到端研发体系 基于 AgentCore 的 MultiAgent Dev Team 与 AgentLoop调优实践_第2页
2026云栖大会资料-「Agent 工程化」方向-15个Agent组成研发小队:多智能体协作的端到端研发体系 基于 AgentCore 的 MultiAgent Dev Team 与 AgentLoop调优实践_第3页
2026云栖大会资料-「Agent 工程化」方向-15个Agent组成研发小队:多智能体协作的端到端研发体系 基于 AgentCore 的 MultiAgent Dev Team 与 AgentLoop调优实践_第4页
2026云栖大会资料-「Agent 工程化」方向-15个Agent组成研发小队:多智能体协作的端到端研发体系 基于 AgentCore 的 MultiAgent Dev Team 与 AgentLoop调优实践_第5页
已阅读5页,还剩8页未读, 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

基于AgentCore的MultiAgentDevTeam与AgentLoop调优实践马云雷阿里云云原生可观测基础平台高级技术专家TECHNOLOGYTREND推理、工具调用、长上下文和反馈闭环,让模型能够在真实环境中持续行动01会生成02会拆解03TECHNOLOGYTREND推理、工具调用、长上下文和反馈闭环,让模型能够在真实环境中持续行动01会生成02会拆解03会执行04会持续推进Coding代码补全、代码问答Coding问题定位、方案设计Coding修改仓库、运行测试CodingCoding场景最先收益:代码仓库可读、工具链标准、结果能够自动测试,因此Coding最早形成了可规模化的Agent行动闭环上下文在角色之间反复交接端到端仅提速需求、方案、测试、联调仍需人串联瓶颈转向协作、等待、验证和返工研发形态升级:从单Agent到从人工串联到流程编排从人的协同到AgentTeam从经验判断到验证闭环一上下文在角色之间反复交接端到端仅提速需求、方案、测试、联调仍需人串联瓶颈转向协作、等待、验证和返工研发形态升级:从单Agent到从人工串联到流程编排从人的协同到AgentTeam从经验判断到验证闭环人人方案设计架构判断人Reviewer人联调验证跨模块/等环境人人人方案设计架构判断人Reviewer人联调验证跨模块/等环境人发布上线风险确认A代码实现CodingAgent已显著加速产品/架构/研发人人测试研发/QACoding单点能力提升代码生成速度显著提升单个研发可并行处理更多任务代码生成速度显著提升单个研发可并行处理更多任务局部修改与测试提速CodingAgent提升一个环节的吞吐,AgentTeam才能提升完整研发流程的吞吐02/AGENTTEAMAgentCore管理角色、调度、任务状态和共享上下文,本地Worker使用Skill与工具执行具体工作Issue需求、Bug、验收标准Issue需求、Bug、验收标准Chat/人工决策补充上下文、关键判断Chat/人工决策补充上下文、关键判断状态回写进度、阻塞、人工请求可观测轨迹过程、决策、反馈与结果代码与PR代码变更、测试与验证报告独立评审语义与对抗验证证据地图环境与发布MultiAgent·中心化调度·状态保持参考锚点结构化方案实现变更测试构建AgentCoreAgentCore管理团队角色、共享状态和协作契约,Worker通过Skill、工具和上下文完成真实执行04/CONTINUOUSTUNING01更新Skill,补充验收样本流程更新后,原有Skill复盘案例文档发布漏同步Agent仍沿用只改中文的旧流程。001更新Skill,补充验收样本流程更新后,原有Skill复盘案例文档发布漏同步Agent仍沿用只改中文的旧流程。03召回已验证流程,核对适用条件复盘案例同类接入问题重复分析04同题回测,按任务类型检查退化说明性示例压缩Prompt后少了追问002复盘案例答疑缺少环境信息信息缺失时容易自行补全前提。检查信息缺口,完善追问策略检查信息缺口,完善追问策略Session行为审计Session行为审计TraceToolCall版本评估结果共同基础:行为可追溯轨迹与版本记录支撑问题归因05/AGENTCORE×AGENTLOOP运行数据上行运行数据上行OTel/SDK/探针Trace/Session/TrajectoryToolCall/Outcome/Cost调优资产回流Prompt/Skill/Tool/实验回测或质量门禁通过后发布AgentLoop优化面专家驱动人工判断与调优聚类、归因与建议动态上下文经验与记忆召回AgentCore运行面运行时加载Prompt/SkillAgentCore采集真实运行证据,AgentLoop完成评估与调优,验证后的资产回到下一次执行Memory记忆库事实、偏好与连续上下文DatasetBenchmark/BadcaseSkill资产文件、版本、发布与调优Experiment本地实验/拨测/Benchmark评测质量与成本归因质量门禁Experience经验库Workflow/运行经验Pipeline清洗·过滤·采样·合成轨迹持续评估轨迹聚类持续执行AgentTeam产生结果与运行证据上下文调优数据与评估观测与证据调整Agent调优建议语义召回实验回测专家确认上下文注入EvaluationSession/Trace/轨迹/数据评估Trajectory轨迹Step·Tool过程还原实验或质量门禁确认结果后,形成版本化资产并接入AgentCore成本与效率Token/Step/ToolAgent可观测调用链·时延·错误Trace采集OTel·探针·SDKSession会话多轮上下文聚合Prompt资产版本、对比与发布行为审计留痕·风险查询评估归因归因到具体标签基于真实运行证据持续评估与调优06/PRACTICE离线Benchmark校准AgentTeam,在线Experience减少下一次任务的探索与返工专家历史Commit真实实现作为参照同题实验回测验证新版本是否真实改善AgentCore真实运行轨迹从成功与失败轨迹中提炼可复用经验来源、适用边界与验证结果按任务意图匹配相关经验注入Researcher/Explorer/WorkerSOP稳定工作流与步骤顺序ToolRoute工具选择、调用顺序与契约RepairRule经过验证的问题修复路径Anti-pattern失败模式与规避条件实践A/离线Meta-Loop以人类专家代码作为目标基线实践B/在反向整理题目保留目标与验收条件调优各模块Skill/Tool/State/HarnessAgentTeam解题不读取目标答案Diff+轨迹评估看结果也看过程可检索经验进入下一次任务,动态注入后产生新的Trace07/CODINGLOOP带记忆迭代参考锚定分级验证与收敛AgentCore编排研究、方案、候选实现与独立审查,带着反馈逐轮改进带记忆迭代参考锚定分级验证与收敛Judge/Verify候选选优语义验收对抗审查理解需求与代码库构建问题证据地图锚定参考实现产出候选方案代码与变更说明测试、审查证据通过边界缺陷:保留代码增量修复方案错误:带失败反馈重新Judge/Verify候选选优语义验收对抗审查理解需求与代码库构建问题证据地图锚定参考实现产出候选方案代码与变更说明测试、审查证据通过边界缺陷:保留代码增量修复方案错误:带失败反馈重新Research/ExploreAgentCoreAgentCore/Leader角色调度与状态保持按失败类型选择下一步内层Loop:编译与测试CodeWorkerTest/HarnessCodeWorker内层Loop:编译与测试CodeWorkerTest/HarnessCodeWorkerTest/HarnessCodeCodeSession08/OUTCOME离线盲测离线盲测19道题逐题对照专家代码等价10接近5线上交付

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论