国君多个团队对OpenAI发布的o1大模型(草莓模型)进行解读,认为其推理能力大幅提升,推动AI产业加速前进。
核心观点与关键数据:
- 推理能力突破: o1模型通过强化学习训练,首次证明语言模型可以进行真正的强化学习,推理能力可沿着Scaling Law提升,实现真正的“智能”。o1在回答前会产生内部思维链,进行长时间思考,分解复杂步骤,尝试不同策略,并优化答案。
- 双曲线共同增长: o1模型不仅拥有训练时的Scaling Law,还拥有推理层面的Scaling Law,双曲线共同增长将突破大模型能力提升瓶颈。
- 算力需求持续性: o1通过思维链进行推理,反复试错导致推理算力需求远超传统LLM。Cognition AI评估显示,gpt-4o、o1预览版、o1正式版的推理能力评分分别为25.9%、34.6%、51.8%。
- 应用场景广泛: o1系列模型可用于处理代码、注释细胞测序数据、生成复杂数学公式等,推动AI应用落地,出现Killer级应用指日可待。
团队观点:
- 国君海外科技团队: 认为o1模型验证了算力需求持续性及AI应用落地的光明前景,具备推理能力的更智能的大模型将进一步打开AI应用落地的空间。
- 国君电子团队: 看好o1和o1 mini在推理端处理复杂任务的能力,认为新模型的持续迭代将继续拉动AI算力基建。o1系列模型强调推理性、准确性和专业性,o1 mini则是一个强调成本效益的高效推理模型。
- 国君计算机团队: 认为o1模型突破人工智能能力新水平,学会人类“慢思考”,在处理数学、编程、代码、优化等高难度问题时发挥重要作用,但仍处于应用早期,算力成本高昂。
- 国君传媒团队: 关注AI推理能力提升对游戏、应用、智慧教育的推动,认为o1为代表的推理能力较强的模型将有助于游戏产业,并改善各类AI应用场景效果,智慧教育或可加速推进。
研究结论:
o1大模型的发布标志着AI推理能力的重大进步,推动AI产业加速前进,进一步打开AI应用落地的空间,出现Killer级应用指日可待。同时,AI算力基建也将持续提速,但o1模型仍处于应用早期,算力成本高昂。
风险提示:
AI相关的资本金投入不及预期、AI相关政策落地不及预期、AI相关的投入产出比不及预期、AI相关公司的营收不及预期。