版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
正文目录TOC\o"1-2"\h\z\u本周模型发布、商业化数据总结 4本周重点事件 5头部模型公司合计收入仍在提速 5Harness对长时程任务的性能贡献获得直接验证 5开放模型进入垂直模型生产环节 6模型—芯片协同降本,国产算力进入规模化生产验证 7各厂商其他动态 9DeepSeek 9字节跳动 9通义 93.4智谱 10MiniMax 10Kimi 10Anthropic 10OpenAI Gemini 12风险提示 13图表目录图1:OpenAI与Anthropic合计年化收入增速进一步提升 5图2:Anthropic客户支出同比保持高增,但增速均开始放缓 5图3:在H3基础上后训练的H3Max在视频生成质量与速度评测中均居首位 6图4:MiniMax商业化数据 7图5:Qwen3.8-Flash在1M上下文下的Prefill吞吐达到Qwen3.7-Plus的8.6倍 7图6:GLM-5.3-Flash以0.045美元折后单任务成本进入全球智能成本帕累托前沿 7图7:GLM-5.3-Flash匿名测试调用量在两大平台周榜登顶,全部流量均由国产AI芯片承载 8图8:Jalapeño在三类大模型上的峰值混合吞吐达到现有最佳水平的1.5—1.9倍 8图9:Jalapeño每瓦推理性能最高约为7月版Rubin的两倍 8图10:Seedance将人手替换为机械手,右为原视频,左为生成效果 9图在Arena视频编辑竞技场中位居第一 9图12:MHS作为人工智能代理和多种设备之间的“翻译”层 图13:Gemini3.5TranscribeLive在多语言流式语音识别评测中错误率最低 12图14:GeminiOmni1.1Flash覆盖360p至4K,定价为0.03—0.30美元/秒 12表1:本周模型发布情况 4表2:本周商业化数据总结 4本周模型发布、商业化数据总结表1:本周模型发布情况发布方模型类型/形态核心信息GoogleGemini3.5Transcribe语音转录模型流式/WER4.0%/2.6%Chirp370%85种以上语言GoogleGeminiOmni1.1Flash视频生成模型4K40秒;360p60%,成本约为标准720p的1/3阿里Qwen3.8-Flash多模态MoE模型125B总参数、6B激活参数;1M上下文Prefill吞吐最高为Qwen3.7-Plus的8.6倍阿里Qwen3.8-Flash-Next开放权重模型验证Next新架构,并作为Qwen4系列的架构雏形智谱GLM-5.3-FlashMoE模型320B总参数、18BGLM-5.31/10,生AI芯片承载HarveyTenet法律垂类模型基于KimiK3后训练;内部基准全通过率由约11%升至19.7%,推理成本低于闭源前沿模型的1/4ThomsonReutersThomson企业自研行业模型Qwen3.5-397B4,000万美元,强调长期成本与调整自由度falResearchH3Max后训练视频模型基于MiniMaxH3后训练,在第一方和第三方评估中于整体质量、提示理解和美学维度领先各公司官网/官方账号,Biggo,IT之家表2:本周商业化数据总结主体收入及ARR毛利、利润及成本用户及使用量收入结构、定价及渠道等OpenAIAnthropic合计202321202465亿美元、2025年30020268月131,0503.1倍、4.7倍和年内3.5倍———Anthropic7月客户总支出同比增长约2,800%,但支出增速首次放缓—客户增长连续第二个月下降IPO招股书预计潜在市场规模超过30万亿美元OpenAI——巴西ChatGPT用户量一年内近翻倍;Codex周用户数较年初增长超过11倍ChatGPTBusinessPremiumSeats100美元/月,用5展至印度,并在巴西启动本地商业运营MiniMax2026H1收入1.17亿美元,同比+283.1%;截至8月ARR超过8亿美元毛利润2,081.3万美元,同比+464.8%;毛利率17.9%;归母净利润亏损3.58亿美元,亏损同比收窄11%7Token1月的20倍B端收入占比由2025年约30%升至2026H1的60%以8月,ToBToC在ARR中的占比约为8:2DeepSeek———9:00—12:00、14:00—18:00执行高峰价格,其余时间及周末执行低谷价格阿里/Qwen——827日,Qoder全600用企业超过10万家—各公司官网/官方账号,EpochAI,YipitData,IT之家等本周重点事件模型收入仍在快速增长,但竞争和价值创造已不再局限于基模本身。复杂任务推动Harness成为独立竞争层,开放模型使垂直厂商能够通过后训练掌握更多模型能力,持续增长的调用需求则进一步推动模型、芯片与算力基础设施协同优化。头部模型公司合计收入仍在提速年度维度上,据EpochAI,OpenAI与Anthropic两家公司合计收入在更高基数上继续提速:两家公司合计年化收入由2023年末的21亿美元增至2024年末的65亿美元、202530020268131,050亿美元;2024年、2025年分别增长3.1倍、4.7倍,2026年至8月13日已增长3.5倍,收入扩张速度逐年提升。图1:OpenAI与Anthropic合计年收入增速进一步提升 图2:Anthropic客户支出同比保持增,但增速均开始放缓 EpochAI YipitData月度维度上,Anthropic客户总支出与客户增长边际放缓。据YipitData,2026年7月Anthropic2,800%,但支出增速首次放缓,客户增长也连续第二个月下降。与此同时,OpenAI100美元、ChatGPTBusinessPremiumSeats,将广告业务由美国、欧洲扩展至印OpenAI企业业务收入增速加快、与Codex2,000万的数据,Anthropic阶段性放缓更多反映头部厂商增长节奏和竞争格局的变化,尚未改变两家公司共同推动的市场扩张。收入继续增长的同时,模型厂商对长期市场边界的定义也在扩大。Anthropic在IPO招30SpaceX28.5万亿美元,反映公AI纳入长期商业化范围。Harness对长时程任务的性能贡献获得直接验证继上周DeepSeek、OpenAI与MiniMax等厂商集中开放或展示Harness后,本周英伟达研究进一步量化了模型外执行系统的作用。ClaudeOpus5Harness并ARC-AGI-330%100%;OpenAI上月也曾仅通过调HarnessHarness下出现显著性能差异,说明长时程任务的最终表现已不能只用基模能力解释。研究结果与厂商产品方向相互印证。OpenAI正在测试可持续运行并主动创建后续任务CodexPersistent模式;ClaudeCoworkCowork与聊天功能之间的记忆;豆包工作则通过与飞书深度整合,继承企业权限、知识和工作上下文,并将任务结果继续沉淀回企业系统。各家均在补充持续运行、上下文管理、工具调用和任务反馈能力,使Agent由单次回答进一步走向复杂工作流程。模型外执行系统本周进一步获得性能测试和产品更新的共同验证。模型仍决定能力基础,但Harness正在更直接地影响模型能否长期、稳定地完成任务,Agent竞争由基模延伸至执行系统的趋势更加清晰。开放模型进入垂直模型生产环节上周第三方平台数据主要验证了开放模型调用量、支出份额和企业采用的提升;本周Harvey、ThomsonReuters与falResearch的案例进一步表明,开放模型已经开始成为下游厂商生产垂直模型的底座。Harvey此前长期采购OpenAI、Anthropic和Google等闭源模型API,每月处理约13万亿Token;本周则以KimiK3为底座,与FireworksAI使用约150张B300、历时两个月训练首个自研基础模型Tenet。Tenet在Harvey内部LAB基准上的全通过率由约11%提19.7%1/4。场景,并使应用厂商能够利用自身数据和评测体系持续优化模型。这一变化并非局限于单一行业。ThomsonReuters基于Qwen3.5-397B开发首款自研大语言模型Thomson4,000万美元,并将长期使用成本和调整自由度作为选择开放模型的重要原因;falResearch则基于MiniMaxH3推出后训练视频模型H3Max,在第一方和第三方评估中于整体质量、提示理解和美学维度取得领先。法律、专业服务和视频生成等不同场景均开始采用“开放底座行业后训练”的技术路径。图3:在H3基础上后训练的H3Max在视频生成质量与速度评测中均居首位fal官方账号下游自研需求增加的同时,国产底座模型的商业化数据也在改善。MiniMax2026H1283.1%8ARR8BARR中的占比已升至80%,7120倍。图4:MiniMax商业化数据IT之家,证券时报,MiniMax半年报,智东西公众号模型芯片协同降本,国产算力进入规模化生产验证本周国产芯片开始在数万卡生产集群中承载真实流量,模型与芯片协同优化进一步成为推理降本和规模扩张的重要支撑。模型端,Qwen3.8-Flash125B总参数、6BMoEGDNQSAHybridPrefixCache90%1MPrefill吞吐达到Qwen3.7-Plus8.6倍。GLM-5.3-Flash采用320B总参数、18B激活参数,标准价格仅为GLM-5.31/10Agent任务成本。图5Qwen3.8-Flash1MPrefillQwen3.7-Plus8.6倍
图6:GLM-5.3-Flash以0.045美元折后单任务成本进入全球智能成本帕累托前沿 EpochAI YipitData更重要的是,GLM-5.3-Flash匿名测试(调用量在OpenRouter与OpenCode两大平台周榜登顶)的全部流量均由国产AI芯片承载,生产集群已覆盖数万颗国产加速器,端到端服务性能较初始版本提升3倍。规模生产集群和真实调用,模型架构、推理系统与国产硬件的协同优化开始取得生产端验证。MiniMaxM3H3的国产芯片适配,大规模国产算力集群将逐步承担真实生产流量。图7:GLM-5.3-Flash匿名测试调用量在两大平台周榜登顶,全部流量均由国产AI芯片承载智谱官网海外厂商则继续通过自研芯片掌握推理效率。OpenAI公布首款定制推理芯片Jalapeño120B、DeepSeekR1KimiK2.51T上,其峰值吞吐下每瓦任务量1.5—1.91.7—3.6倍,高交互工作负载性能达到对比系2.1—4.1SemiAnalysis,Jalapeño7Rubin的两倍。图8Jalapeño吞吐达到现有1.5—1.9倍
图9:Jalapeño每瓦推理性能最高约为7月版Rubin的两倍OpenAI官方号 SemiAnalysis效率优化与长期算力扩张同步推进。Anthropic与Nscale签署约450亿美元、为期六TPUAmirSalek800亿港元AI模型厂商推动国产芯片进入规模化生产,算力竞争正由单纯采购芯片进一步转向模型、系统与硬件的全栈协同。各厂商其他动态DeepSeekDeepSeek自8月23日起再次调整API峰谷计费规则:9:00—12:00、14:00—18:00费。该机制通过扩大低价时段,引导调用需求向非高峰期迁移。字节跳动火山引擎继续建设具身智能数据基础设施,提供从数据采集、处理、标注、管TOP2015家开展深度合作。图10:Seedance将人手替换为机械手,右为原视频,左为生成效果火山引擎公众号⚫发布“豆包工作”,与飞书深度打通:豆包工作能围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程;通过与飞书的深度打通,可完整继承飞书权限范围内的企业知识和工作上下文,用户和豆包工作一起创作的内容和知识也会持续沉淀回飞书。通义Wan3.0在Arena视频编辑竞技场中位居第一,分别领先Seedance2.5和MiniMaxH3约4分和22分。图11:Wan3.0在Arena视频编辑竞技场中位居第一阿里巴巴官方账号⚫ 截至8月27日,Qoder全球累计用户超过600万,使用企业超过10万家。智谱GLM-5.3-Flash发布:总参数320B、激活参数18B;0.045元,智能成本进入全球帕累托前沿;在多项基准测试和真实工作负载中的表现均GLM-5.2,而价格仅为其1/10;在编程和Agent能力基准上的表现已接近ClaudeOpus4.8;匿名实测调用量在两大平台登顶,全部测试流量由国产AI芯片承载,生产集群已覆盖数万颗国产加速器。GLM-5.3-Flash定价每百万tokens输入/输出¥0.8/¥2.8(限时两周5折:¥0.4/¥1.4,为LM-53的1/10,限时折扣内为LM-5.3的1/0,为pus4.8的1/40。MiniMaxM3Pro的参数规模预计提升至约3T,并进一步扩大强化学习和长程任务训练。正在推进M3和H3的国产芯片适配,大规模国产算力集群将很快上线,并逐步承担真实生产流量(证券时报。KimiHarvey于8月20日发布首个自研基础模型,以KimiK3为底座进行法律领域后训练:HarveyFireworksAI150B300、两个月完HarveyLAB基准上,全通过率由约19.7%,推理成本低于闭源前沿模型的1/4(注:Harvey服务于全球数千家顶级律所和超过20OpenAI、AnthropicGoogle等闭源模型厂商13tokenAPI采购。Anthropic前谷歌TPU项目创始高管之一阿米尔·萨莱克(AmirSalek)将加入Anthropic的算力团队:2022TPU业TPU芯片(彭博社。发布模型硬件标准(MHS)研究预览,让AI智能体安全操控物理设备:MHS使AI智能体能够并行操作多种实验室与制造仪器,例如显微镜、液体处理器和机械臂,并执行从常规药物发现实验到量子计算机激光校准等复杂任务,可将原本需要数周的设备集成工作缩短至几小时。图12:MHS作为人工智能代理和多种设备之间的“翻译”层Anthropic官方账号美国加州北区地方法院法官裁定,五角大楼今年早些时候将Anthropic列入“供应链风险”黑名单的行为违宪,属于“违反第一修正案的非法报复”。Salesforce与Anthropic合作推出Claudeforce:除在Salesforce内部可使用Claude外,还合作推出包含了37种预构建的销售技巧的插件,帮助销售人员ClaudeClaude、SalesforceSlack之间的功能。OpenAI发布首款定制推理芯片Jalapeño测试结果,并将在接下来的几个月里逐步扩大其部署规模:GPT‑OSS120B、DeepSeekR1KimiK2.51T上,JalapeñoAI1.51.91.73.6倍;对于高度交互式的工作负载,其性能达到对比系统的2.1至4.1倍。于8月25日全面恢复5小时限额(该限制曾自7月13日起解除,但价格Pro套餐在未来几个月仍将继续保持“5小时额度限制”。推出ChatGPTBusinessPremiumSeats:$100/5倍。正在开发几款硬件设备:包括“一款放在桌上的设备、一款可以放进口袋的设备,以及一款可穿戴设备”,其中首款产品预计将是一款小型圆盘(puck)备,能够感知周围环境,并通过语音模式与用户交流,预计于2027年初推出;Altman还表示,OpenAI未来“肯定”会开发人形机器人(时代杂志。正在为Codex开发一种名为“Persistent(持续运行)”的模式:将成为一种新Codex能够“持续工作,直到被要求进入休眠状态”,这一Agent还可以主动为自己创建后续任务;OpenAI已向WIRED证实,公司正在测试这一功能,但目前没有近期上线的计划。将在印度向ChatGPTFree和Go套餐用户投放广告:首批广告将覆盖50个最低日预算为725印度卢比;OpenAI今年2月首先在美国向用户展示广告,本月早些时候则将广告业务扩展到欧洲。在巴西圣保罗设立本地团队并启动商业运营:巴西是ChatGPT2.15OpenAIAPI开发者数量全球第二,Codex周用户数自2026年初增长超11倍,日均交互次数增长近30倍。OpenAI表示,Astra是其迈向AGI的核心模型家族:可自主编写代码、运行实验并完成原本需研究人员约一周的工作,同时支持可长期自主执行任务的PersistentAgents;Altman预计,Astra将具备以实际有意义的
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2025-2026年北师大版高二地理第8章工业地理练习题
- 2025-2026年上海市苏教版初中二年级道德与法治第8章单元检测卷
- 2025-2026年重庆市人教版小学二年级语文下册第12单元课文背诵练习题
- 2026年山东省苏教版九年级物理下册第4章电学综合测试题
- 2025-2026年江苏省苏教版八年级物理第11单元电学习题
- 新生儿胃食管反流病护理
- 白血病M3护理查房
- 2026年抗战胜利纪念日研学活动方案课件
- 医学课件-化疗药物外渗应急流程
- 2026年坚壁清野成语故事历史典故拓展教案
- 2026年吉林事业单位考试真题及答案
- 2026学年人教版新教材小学数学六年级上册教学计划(含进度表)
- (2026版)十八项医疗质量安全核心制度课件
- 2026秋人教版小学数学一年级上册(新教材)教学计划含进度表
- 2026年库车市招聘市属国有企业工作人员(62人)考试参考题库及答案详解
- 2026绍兴诸暨市综合行政执法局执法辅助人员招聘35人笔试备考试题及答案详解
- 2026年初级注册安全工程师《安全生产法律法规》真题及答案(浙江)
- 2026年中级会计师《中级经济法》考试黑钻押题及完整答案详解(夺冠)
- 学校校区内施工采取的专项安全文明措施
- 2026年金钥匙科技竞赛考试题库含完整答案详解【夺冠】
- 2025年-华为车bu结构与材料工程师笔试及答案
评论
0/150
提交评论