核心观点与关键数据
OpenAI发布o1大模型(草莓模型),推理能力大幅提升,验证了算力需求的可持续性及AI应用落地的光明前景。
推理能力提升
- 科学能力:高水平的数学竞赛测试中,GPT4o、o1预览版、o1正式版准确率分别为13.4%、56.7%、83.3%;博士级科学问题测试中,准确率分别为56.1%、78.3%。
- 编程能力:一段提示词即可让o1写出一个完整可运行的游戏,模拟编程竞赛中超越93%的人类竞争对手。
- 价格:o1-preview和o1-mini每百万token输入价格分别为$15/$3,输出价格分别为$60/$12,是GPT-4o的3倍/60%和4倍/80%。
技术突破
- o1首次证明语言模型可进行真正的强化学习,推理能力可沿Scaling Law提升,走向真正的“智能”。
- o1通过思维链进行推理,进行反复试错,推理算力需求远超传统LLM。
- o1性能可通过提高强化学习和思考时间而持续提高,拥有训练时和推理层面的Scaling Law。
应用前景
- o1系列模型提升处理代码的智能体系统,Cognition AI评估显示o1正式版评估分达51.8%。
- 可用于注释细胞测序数据、生成量子光学所需的复杂数学公式等。
- 具备推理能力的更智能的大模型将进一步打开AI应用落地的空间。
行情回顾
- 大盘:恒生指数下跌0.43%,恒生科技指数下跌0.23%,道琼斯工业指数上涨2.60%,纳斯达克指数上涨5.95%。
- 板块:恒生互联网科技业指数下跌0.42%,HK AIGC概念指数下跌1.35%,纳斯达克中国金龙指数上涨1.03%。
- 重点个股:港股前三为阿里巴巴-W(+3.7%)、小米集团-W(+3.7%)、美团-W(+3.1%);美股前三为嘉楠科技(+16.8%)、AMD(+13.4%)、叮咚买菜(+13.1%)。
AI行业要闻
- 特斯拉2025年末批量装备Dojo 2,对标英伟达B200。
- 字节探索AI耳机、眼镜等产品,与豆包大模型联动。
- 黄仁勋重申英伟达需求旺盛,B系列四季度开始出货。
- 英特尔求助美国政府,鼓励英伟达、苹果使用英特尔代工。
- 腾讯最新万亿参数异构MoE上线,权威评测国内第一。
- 谷歌推出DataGemma基于可信数据源提高AI准确度。
- 黄仁勋、奥特曼等会见白宫官员讨论美国AI基建布局。
- 三星电子计划裁员15%销售人员及30%行政人员。
- 日本加强对中国先进芯片和对应制造设备的出口管制。
研究结论
具备推理能力的更智能的大模型将进一步打开AI应用落地的空间,出现Killer级应用指日可待。