核心观点与关键数据
定价优势
- API阶梯定价:3美元/15美元每百万tokens,对标海外主流闭源模型,降低企业Agent落地成本。
综合测评实力
- 整体能力超越Opus 4.8,逼近Claude Fable 5、GPT-5.6 Sol顶级闭源模型。
- 多项基准跻身全球前列:
- 通用知识工作GDPval-AA v2:全球第3(仅落后Fable 5 Max、GPT-5.6 Sol Max)
- Agent智能工作AA-Briefcase基准:全球第2(仅次于Fable 5 Max)
- 长文本复杂信息检索BrowseComp:行业SOTA(最优水平)
底层核心技术创新
- 混合MoE架构
- 采用KDA混合线性注意力+AttnRes残差优化+高稀疏LatentMoE(896选16)组合方案。
- 模型scaling效率提升2.5倍,优化Agent智能体、长周期代码任务,降低运行成本。
- API工程优化
- 动态工具加载:支持自定义工具注入,适配自动化Agent开发。
- 1M超长上下文自动缓存机制:重复内容复用缓存,降低token计费成本,提升长文本处理速度。
优势场景
- 视觉能力突破
- 3D建模、游戏视觉场景表现超越Claude Fable 5。
- 长时序复杂视觉任务达到全球SOTA水准。
- 代码工程全链路适配
- 可完整读取大型代码仓库、操作终端程序、自动调度多工具、定位运行报错、自主修复迭代。
- 覆盖逆向工程、游戏开发、前端、CAD工业设计、服务器基础设施优化等长周期开发任务。
行业核心结论
- 首次在超大参数全能通用模型赛道,将国内与海外顶级SOTA模型的代差压缩至3个月以内(此前仅GLM-5.2在编程领域局部追赶)。
- 成本竞争力突出
- API定价对标Claude Sonnet,缓存方案定价与GLM-5.2持平。
- 兼顾顶级性能与亲民成本,利好企业端大规模落地。
- 产业催化
- Kimi K3落地后,市场对智谱GLM、DeepSeek、通义千问、MiniMax等国内头部厂商下一代新模型预期显著抬升。
- 补充说明
- 当前仅为初见点评,待官方完整技术报告、海量用户实测反馈落地后,将更新深度技术解读。