核心观点与关键数据
- 模型智能进展:中国模型在智能方面正逐步缩小与美国的差距,例如 DeepSeek、Qwen、Kimi 和 MiniMax 等模型在 Arena Elo 评分中位列前茅。中国模型在混合专家(MoE)架构、线性注意力和模型浮点利用率(MFU)方面表现出高成本效率。
- K3 发布影响:K3 模型发布后,相关 AI 实验室获得融资,计算需求增加。K3 模型在模型智能方面取得显著进展,接近全球顶尖水平,但参数量少于 GLM-5.2。
- Zhipu 和 Stepfun 动态:Zhipu 强调其扩展法则在数据、环境、强化学习和基础设施方面的持续加速,GLM-5.2 参数量少于 K3,预计在规模扩展后能超越 K3。Stepfun 则指出智能体成为生产力基本单元,AI 与终端的集成是下一个重点。
- 成本效率:根据 Silicon Data LLM 代币支出指数和 Artificial Analysis 数据,中国模型的 API 成本远低于美国模型,成本效率显著。
- 视频生成模型:视频生成模型领域未见显著变化,Kimi 的创始人表示当前重点在于模型智能。
- 企业应用进展:Tencent 的 WorkBuddy 获得关注,月活跃用户达 885 万。BABA 发布 Meoo 企业应用,Baidu 展示 Baidu Drive、Baidu Wenku 和 Xiaodu 等 AI 产品,Kingsoft Office 发布 Lingxi 专业和 WPS AI Hub。
研究结论与展望
- 未来模型发布:预计 Qwen(Qwen 3.8、2.4T)、MiniMax(M3 Pro)、Zhipu(GLM)和 Tencent(Hy4)等模型将相继推出。BABA 的 Qwen3.8 为开放权重模型,将在多个平台可用。
- 营收目标:多家公司预计在 2026 年或 2027 年初实现超过 10 亿美元 ARR,包括 BABA、Zhipu、MiniMax、Kling 和 Volcano Engine。Kimi 的 ARR 增长值得关注。
- BABA 优势:BABA 在模型、云、芯片和应用方面具备全栈能力,预计将脱颖而出。
- 投资建议:Jefferies 维持对 BABA 的“买入”评级,认为其全栈能力使其在 AI 领域具有显著优势。
关键数据指标
- Arena Elo 评分:Anthropic、xAI、Google、OpenAI、Alibaba 和 DeepSeek 位列顶尖。
- 代币支出指数:Silicon Data LLM 代币支出指数在 1.56 至 1.61 之间波动,远低于 2.04 的五月水平。
- 模型价格对比:中国模型在输入和输出价格方面均显著低于美国模型。
行业趋势
- 扩展法则:数据、环境、强化学习和基础设施是扩展法则的关键领域。
- 智能体发展:智能体成为生产力基本单元,AI 与终端的集成成为下一个重点。
- 成本效率:成本效率成为模型竞争的关键因素,高效模型在 Coding 和 Agentic AI 领域更具优势。