国产大模型持续迭代:模型能力升级与商业化加速形成共振
核心观点:
国产大模型在模型能力、Agent、多模态、推理系统及商业化等多个维度持续突破,展现出极强的持续迭代能力和全球竞争力,已从Benchmark竞争逐步演进为综合能力竞争。
关键数据与进展:
-
智谱GLM-5.2发布:
- 发布时间:6月16日
- 能力:公司迄今最强的开源模型,支持100万Token上下文,长程任务与Coding能力提升
- 评测:在lmarena webdev coding榜单全球排名第二(仅次于Claude Fable 5)
- 开源协议:MIT协议
-
MiniMax M3发布:
- 发布时间:6月1日
- 架构:456B参数MoE架构,45.9B激活参数
- 能力:具备顶级Coding能力、100万Token上下文及原生多模态能力
- 评测:在SWE-Bench Verified、BrowseComp、MCP Atlas等核心评测中达到全球领先水平
- 技术突破:通过自研MSA稀疏注意力架构,100万Token上下文场景下Prefill提速9.7倍、Decoding提速15.6倍,显著降低Agent运行成本
-
商业化加速:
- 海外市场:Claude Fable 5价格相比opus 4.8翻倍,打开大模型能力和价格上限
- 国内市场:DeepSeek V4计划7月中旬上线,实施API峰谷定价机制(高峰时段价格翻倍)
- 财务预期:国产模型ARR(经常性收入)提升有望加速
研究结论:
看好国产大模型商业化进展持续加速,其已在模型能力、Agent、多模态等方面取得显著突破,综合竞争力提升,未来商业化进程将加速推进。