版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
图表索引图1:Kimi发历程 4图2:KimiK1.5的数、代、多模态推理能力在long-CoT模式下达到OpenAIo1正式版的水平 9图3:KimiK2单步训损失线 10图4:K2采用的大模Agent数据合成框架 10图5:KimiK2.7Code提升了Token效率 11图6:KimiK3架构 12图7:FrontendCodeArena榜单 13图8:多维度代码力基准测评 14图9:KimiK3输的模拟长十号火箭发射与回收 14图10:KimiAgentSwarm智能集群调度架构示意图 15图11:ArtificialAnalysisIntelligenceIndex榜单排名 16图12:KimiApp的月活跃用规模 17图13:Kimi会员订阅套餐益详情 19图14:Kimi算力缺与会员停开放的说明 20图15:Kimi年化收入在K3布节点录得历史最单日增幅 21表1:Kimi产矩阵 5表2:月之暗面核创始人及理团队 6表3:Kimi模迭代 8表4:Kimi模定价 18表5:国内外主流型API价对比 18表6:国内外主流型厂商人AI订阅及Coding/Agent套餐价格对比 20表7:月之暗面融历程 22图1:Kimi发展历程
一、月之暗面:从长文本到专注基模,前沿模型公司的快速转型(一)从长文本切入,历经“流量扩张、重回基模、能力变现”2023Transformer-XLXLNet等长序列/NLP10KimiChatC2024年CQuestMobile12月,KimiApp月活跃用户数达2101万。通过这一阶段的集中投入,初步完成了品牌心智与用户基础积累。20257MoE模型KimiK2发布,主攻Coding与Agent场景。(2026至今2026年,K2.5/K2.6等模型发布后,API1237资金额约35亿美元,投后估值升至约350亿美元。(News)数据来源:Kimi官网,Kimi官方微信公众号,北京日报,SensorTower官网,IT之家,北京商报,证券时报,广发证券发展研究中心表1:Kimi产品矩阵
(二)C端应用与B端开放平台双轮驱动CAIBAPI两类业务共享底层模型与推理基础设施。C端由ChatBot向通用Agent平台演进。KimiKimiKimiWorkKimiCodeKimiAgent、AgentSwarmKimiWorkKimiCodeCLI、IDE插件等形态进入开发者工作流。C端商业模式主要为分层订阅+额度计费。Kimi面向不同使用强度设置免费版及19美元、39美元、99美元199美元/AgentAgentSwarmKimiCode额度、AgentCodingARPU。B端以模型API为核心,并向企业级服务延伸。KimiK3、K2.7CodeK2.6等不同TokenAPI315美元/Coding90%API外,AIC端与B端并非相互独立,而是共同承担模型能力商业化。C端产品将底层模型封装为用户可直接感知的任API等高价值场景,CB(数据来源:Kimi官网)产品 产品形态 目标客户 主要能力 商业化模式产品 产品形态 目标客户 主要能力 商业化模式与 入Kimi Web/App通用AI与 入Agent
对话、联网搜索、深度研究、多模态文件处理、Agent及AgentSwarm等复杂任务执行
Freemium与分层会员订阅,额度耗尽后可通过加油包补充;国内与海外采取差异化会员档位和价格体系KimiWork
macOS/Windows桌面端本地工作流Agent
挂载本地文件、CronWebBridge浏览器自动化、AgentSwarm、Office数据分析
纳入Kimi会员体系KimiCode CLI及VSCode扩展 个人开发者及研发团队代码库读取、文件编辑、命令执行、联网检索、自
纳入Kimi会员体系,不同会员档位配置差异化Code额度;新会员体系Kimi权益将与KimiCode权益拆分AIKimi开放平台 API开放平台及企业AI
开发者、企业及机构客户
提供K3、K2.7Code等模型API、工具调用等 API按Token计费,企业版采用订阅或定制化合作模式数据来源:Kimi官网,广发证券发展研究中心(三)高人才密度,扁平化结构“技术型”硬核学术+工程经历,深耕自然语言处理与长序列建模。杨植麟高中阶段取得清华大学保送资格,并以优异成4NeurIPS、ACL是NLP2019Transformer-XL和XLNet,GoogleBrainMetaFAIR202320万汉字输入Kimi2025DeepSeek20257月Agent1K2.520267K3——2.8100Token上下文,(Anthology;NeurIPSProceedings;金融时报;BusinessInsider)AICTO——(innoHere)表2:月之暗面核心创始人及管理团队姓名 教育背景 职位姓名 教育背景 职位/定位 履历杨植麟 清华大学/CMU 创始人、董事长CEO
循环智能联合创始人张宇韬 清华大学 联合创始人兼CTO 循环智能联合创始人&CTO周昕宇 清华大学 联合创始人 原旷视科技算法研发;ShuffleNet共同第一作者吴育昕清华大学/CMU联合创始人原MetaFAIR研究员;GroupNormalization作者张予彤清华大学/斯坦福大学联合创始人、总裁前金沙江创投主管合伙人;负责整体战略、商业化及融资数据来源:杨植麟个人主页,清华官网,CMU官网,吴育昕个人主页,广发证券发展研究中心300(二、模型端:从长上下文突破走向前沿智能,模型能力持续进化表3:Kimi模型迭代
Kimi。k1.5MoEThinkingK2.5K2.6K2.7Code进一步将底座能CodingAgent3MoE架构,再次抬升了模型能力上限。我们认为,Kimi在公司已初步形成底座周期性升级、后训练高频迭代及产品快速承接的研发体系。模型 发布时间 参数模型 发布时间 参数训练数据 上下文输入输出模态API价格(/1M,缓存输入输入/输出Attention MoE/FFN /对齐关键技术迭代与定位Kimik1 2024-12-16- - -文本+视觉
Text/Image→TextText/Image→
视觉思考模型-----强化学习Long-CoTRL;128K---RL上下文、partialrollout、Long2ShortMLA64构建真实MCP工具+Heads;MoE;384合成工具、Agent、任$0.15/$0.60/MuonClip约experts,务及多轮轨迹的数据$2.50束Attentiontop-8routed合成体系;联合采用Logits、提升+1sharedRLVR与Self-Critique训练稳定性RubricReward重点强化真实软件工$0.15/$0.60/继承K2$2.50继承K2程、长程Coding及前端生成;具体增量数据和RL配方未披露后训练阶段引入QAT;长思考与工具$0.15/$0.60/继承K2继承K2调用交错训练,扩展$2.50思考Token和工具调用步数;多模型合成数据SFT$0.10/$0.60/继承K2继承K2+文本视觉联合RL+联合训练15.5T联合训练15.5TMoE;1Ttokens;Web2025-07-11total/32BText/Code/128KactiveMathematics/KnowledgeMoE;1T2025-09-05total/32B-256KactiveMoE;1T2025-11-06total/32B-256KactiveMoE;1T在K2-Base上继续预训练2026-01-27total/32B约15Tmixed256Kactivevisual/texttokensMoE;1T2026-04-20total/32B-256KactiveMoE;1T2026-06-12total/32B-256Kactive
128K
Text
思维与短思维,整体能力接近o1KimiK2KimiK2-0905KimiK2Thinking
Text→TextText→TextText/Image/Video→TextText/Image/Video→Text$3.00Text/Image/$0.16/$0.95/Video→Text$4.00
万亿参数开放权重Agentic模型;用MuonClip万亿参数模型训练,显著token利用效率拓展上下文长度,更强的代码能力,更快的API全面提升Agent和推理能力KimiK2.5KimiK2.6KimiK2.7Code
Text/Image/Video→Text
$0.19/$0.95/$4.00
继承K2 继承K2 强化Coding场景
全能模型,原生的多模态架构设计;最多100个子Agent、1,500个协同步骤,端到端耗时最高缩短4.5×PARL并行Agent强化学习继承K2继承K2强化长程Coding、工PARL并行Agent强化学习继承K2继承K2强化长程Coding、工具调用及AgentSwarm后训练专项Coding模型,显著提升了长上下文编程场景的指令遵循能力、长程编程任务的性能,大幅改善了过度思考倾向KimiK3 2026-07-17
MoE;2.8Ttotal104Bactive
- 1M
Text/Image/Video→Text
$0.30/$3.00/$15.00
KDA+GatedMLA;AttnRes负责提取表征
StableLatentMoE;896experts、16active(约1.8%)
SFT阶段引入QAT,采用MXFP4权重与MXFP8激活;结合完全均衡专家并行提升超大规模MoE后训练效率;
3T放模型;面向长程Coding推理;仅次于ClaudeFable5和GPT5.6Sol数据来源:Kimi官网,Kimi官方微信公众号,Arxiv,广发证券发展研究中心(一)预训练抬升模型能力上限,后训练将底座能力转化为真实任务表现Kimi202310月,KimiChat20万汉字理的速度、成本与并发效率。随着国内外头部模型陆续扩展上下文窗口,Kimi需要由产品功能领先进一步转数据来源:Kimi)2025年初发布的k1.5将强128KpartialrolloutLong2Short将长链推理能力迁移至更短的推理输出,推动模型在数学、代码和多模态推理任务上持续提升,也为后续向Coding及复杂任务执行方向演进积累了方法。图2:KimiK1.5的数学、代码、多模态推理能力在long-CoT模式下达到OpenAIo1正式版的水平数据来源:KimiK1.5技术报告,广发证券发展研究中心K2完成了万亿参数底座建设。2025年7月,公司发布K2模型,采用MoE架构,总参数约1.04万亿、单Token32638481MuonClipQK-Cliplogit异常增长,15.5TokenlossspikeAgentK2ThinkingCodingAgent图3:KimiK2单步训练损失曲线数据来源:KimiK2技术报告,广发证券发展研究中心图4:K2采用的大规模Agent数据合成框架数据来源:KimiK2技术博客,广发证券发展研究中心K2K2Thinking进一步扩展调试等任务;K2.6CodingAgentAgent100个子Agent、1,500300Agent4,000个步骤。K2.7Code则针对编程场景进行专项后训K2.6Program-Bench、MCPMarkVerifiedSWEMarathon等内部或特定评测上继续提升,同Token30%。(数据来源:Kimi)CodingAgent图5:KimiK2.7Code提升了Token效率数据来源:KimiK2.7Code技术博客,广发证券发展研究中心K3K3MoEK32.8万KimiDeltaAttention、AttentionResidualsStableLatentMoEMoE896个路Token16Scaling效率较K2提高约2.5倍,并成为全球首个3T参数量级的开源模型。(数据来源:Kimi官网)图6:KimiK3架构数据来源:KimiK3技术报告,广发证券发展研究中心K32ikiK..6和.7et和i,(二)Coding、Agent与多模态能力协同演进,进入全球前沿竞争序列CodingToken是当前大模型率先实现商业落地的场景。在Coding方面,K2初步建立软件工程与工具调用能力;K2Thinking进一步融合长链推理与环境交互,在SWE-benchVerified71.3%200-300次工具调用;K2.7CodeAgenticCodingK2.630%Token。()K3CodingGPUKernel717日,Arena.aiFrontendCodeArena最新评测结果,K31679分位列第一,较Kimi-K2.61817ClaudeFable5GPT-5.6Sol48分、617个6(数据来源:Arena)图7:FrontendCodeArena榜单数据来源:Arena.AI,广发证券发展研究中心备注:数据截至2026年7月17日图8:多维度代码能力基准测评数据来源:KimiK3技术博客,广发证券发展研究中心CodingAgentKimi-VLMoEAgent能力;K2.5K2BaseCoding和工具调用能力在同一模型Coding内容生产,模型不再只接收用户最初提供的图片,而可以在任务执行过程中持续读取代码运行结果,通过“visionintheloop图9:KimiK3输出的模拟长征十号火箭发射与回收数据来源:Kimi官方公众号,广发证券发展研究中心AgentScalingAgentAgentKimiAgentAgentAgent并分配工作,最后对结果进行汇总,而非由开发者预先设定固定角色和工作流。具体来看,K2.5Parallel-AgentReinforcementLearning100Agent并执行1,500AgentAgentSwarm4.5K2.6300Agent4,000AgentK3KimiAgentK3(Kimi)我们认为,AgentKimiAgentAgentAgentToken消Agent图10:KimiAgentSwarm智能集群调度架构示意图数据来源:KimiK2.5技术报告,广发证券发展研究中心。ArtificialAnalysis20267月的测试显示,K3在其IntelligenceIndex57ClaudeOpus4.8GPT-5.6Sol处于相近区间。在AA-Briefcase评测中,K3ClaudeFable5ClaudeOpus5max,并GPT-5.6SolGDPval-AAv2K3K3AnalysisK33661Token/s的中位水平;IntelligenceIndex1.30Token9,900Tokenmax推Token图11:ArtificialAnalysisIntelligenceIndex榜单排名数据来源:ArtificialAnalysis,广发证券发展研究中心备注:数据截至2026.07.31三、商业化与资本:能力变现提速,融资夯实储备(一)由投流获客转向模型驱动,海外市场打开成长空间C75.3(数据来源:投中网援引AppGrowing数据)。通过早期集中投入,Kimi2025年,公司主动收缩C端投流,将资源配置重心转向底层模型研发,整体用户活跃度有所回落,其中APP月活跃用户数由2024年12月的2101万下降至2025年12月的903万。图12:KimiApp的月活跃用户规模AppMAU(万)25002000150010005000数据来源:QuestMobile,广发证券发展研究中心商业化结构转型,增长重心由流量获取转向模型能力驱动的B端API调用和C端订阅,以及海外市场拓展。CCB端APICAPI业务在B端收入占比约70%。随着模型能力增强,Kimi的API价格中枢逐步上移,输入输出价格分别从K2Token0.6/2.5K33/15TokenK3发布后整K3ClaudeOpus540%GPT-5.6Sol低约API在编90%Agent任务的实际调用成本,缓解名(Kimi官网)模型发布时间缓存命中输入缓存未命中输入输出价格表模型发布时间缓存命中输入缓存未命中输入输出价格(USD/1M)(USD/1M)(USD/1M)KimiK22025-07-110.150.602.50KimiK2-09052025-09-050.150.602.50KimiK2Thinking2025-11-060.150.602.50KimiK2.52026-01-270.100.603.00KimiK2.62026-04-200.160.954.00KimiK2.7Code2026-06-120.190.954.00KimiK32026-07-170.303.0015.00数据来源:Kimi官网,广发证券发展研究中心公司模型缓存命中输入缓存未命中输入输出价格备注表公司模型缓存命中输入缓存未命中输入输出价格备注(USD/1M)(USD/1M)(USD/1M)ClaudeFable511050-AnthropicClaudeOpus50.5525-ClaudeSonnet50.2210-GPT-5.6Sol0.5530长上下文时输入价为2x,输出价为1.5xOpenAIGPT-5.6Terra0.2212长上下文时输入价为2x,输出价为1.5xGPT-5.6Luna0.020.21.2长上下文时输入价为2x,输出价为1.5x月之暗面AIKimiK30.3315-智谱AI/Z.AIGLM-5.20.261.44.4-DeepSeekDeepSeek-V4-Pro0.0036250.4350.87-DeepSeek-V4-Flash0.00280.140.28-MiniMaxMiniMax-M30.060.31.2上下文>512K时为2x阿里巴巴Qwen3.8-Max0.2061.654.951腾讯Hy30.0330.1320.528-字节跳动Doubao-Seed-2.1-Turbo-数据来源:各公司官网,广发证券发展研究中心C+49元、99元、19969919美元、39美元、99美199(数据来源:Kimi官网)Kimi深度研究、PPT生成、网站部署、KimiWorkKimiCodeTokenKimiCodeKimiCodeCodingCoding(数据来源:Kimi官网)trie6年1imi8%,2月订单数环比进一步增长.%trierie渠道的支付表现,KimiAgent产品能力升级,C图13:Kimi会员订阅各套餐权益详情数据来源:Kimi官网,广发证券发展研究中心表6:国内外主流模型厂商个人AI订阅及Coding/Agent套餐价格对比公司/产品 价格(每月) 产品形态 主要权益及口径公司/产品 价格(每月) 产品形态 主要权益及口径OpenAI/ChatGPT Go:$8;Plus:$20;Pro5x:$100;Pro20x:$200Anthropic/Claude Pro:$20;Max5x:$100;Max20x:$200Andante:¥49;Moderato:
覆盖ChatGPT对话、推理、DeepResearch、图像生成和通用AI会员Codex等能力;通用AI会员通用AI会员覆盖Claude网页端、ClaudeCode、Cowork、通用AI会员KimiWeb、App、Work、Agent、PPT、研究与Kimi月之暗面/KimiMiniMax/MiniMaxCode智谱AI/ZCode
¥99;Allegretto:¥199;Allegro:¥699TokenPlanPlus:¥49;Max:¥119;Ultra:¥469GLMCodingPlanLite:¥118;Pro:¥538;Max:¥1078
通用AI会员个人Coding/Agent阅个人Coding/Agent阅
Code共用一套会员体系;KimiCode额度分别约为1倍、4倍、20倍和60倍。TokenPlan主要面向MiniMaxCode、编程Agent及个人开发者,同时覆盖M3/M2.7、图像、语音、音乐等模型,并非传统聊天App会员。实际购买的是GLMCodingPlan;套餐额度可直接在ZCode及官方支持的其他CodingAgent中使用,API调用另行计费。数据来源:各公司官网,广发证券发展研究中心需求快速增长推动算力扩容,短期暂停新客订阅并优化权益分层。根据官方公众号,K3发布后模型调用需求48CKimi计划KimiCodeKimiWeb、KimiAppKimiWork,KimiCodeK3图14:Kimi算力紧缺与会员暂停开放的说明数据来源:Kimi官方公众号,广发证券发展研究中心Coding、AgentAPI和订阅产品20257KimiK2并开放模型CodingAgent和应用。2025年11K2ThinkingAPI4170%2026年1Coding和Agent4(源:KimiGithub,OpenRouter)ARR由2026年3月约1亿美元提升至6月约3亿美元,K3发布后录得历史ARR最大增幅。2026年,公司ARR呈现明显加速态势,3
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 静脉输液外渗的预防与处理
- 腹腔镜超声在腹腔镜肝胆手术中的应用分析
- 2025年卫生监督所招聘笔试题库
- 2026年伊犁州公安辅警结构化面试题及答案参考答案
- 2026年光明食品集团招聘试题及答案
- 2026年丹纳赫(中国)招聘试题及答案
- 2026年贵州大专分类考试试题及答案
- 乡村振兴与农村人居环境改善策略试题
- 医药销售试用期转正工作总结
- 2026年新高考语文答题技巧详解试卷
- 口腔诊所合理使用抗菌药物的整改措施
- 2026秋小学人美版美术六年级上册(新教材)教学计划附教学进度表
- 2026年河南省重点学校高一入学语文分班考试试题及答案
- 辽宁省沈阳市五校2025-2026学年高二下学期7月期末考试物理试卷(含答案)
- 2026版前列腺癌诊疗指南
- 中国公证协会招聘考试真题2025
- 2026年秋季学期统编版小学五年级上册语文教学计划含教学进度表
- 乘客电梯调试作业指导书
- 2026年全国数据技术与应用职业技能竞赛(商务数据分析与应用)必练题(共350题)
- 2026年秋教科版六年级上册科学每课教学反思
- 2025年江苏南京市中考语文试卷真题及答案详解(精校打印版)
评论
0/150
提交评论