- DeepSeek V3 是基于 Transformer 架构的 671B 参数专家混合(MoE)语言模型,采用创新的负载均衡策略和多标记预测训练目标,并通过 FP8 混合训练精度训练框架大幅提高训练效率,仅以 2.664M H800 GPU 小时完成预训练。
- DeepSeek-R1 是基于 DeepSeek V3 的集大成之作,性能对标 OpenAI-o1,其 Zero 版本通过大规模强化学习(RL)训练,无需监督微调(SFT),展示了自我验证、反射和生成长 CoT 等功能,是首个验证的纯粹通过 RL 激励 LLM 推理能力的开放研究。
- DeepSeek 团队开源了 DeepSeek-R1-Zero、DeepSeek-R1 及六个基于 Qwen 和 Llama 提炼的密集模型(1.5B-70B),部分测试性能超越 OpenAI o1-mini。
- OpenAI 发布 o3-mini 和 Deep Research 作出回应,o3-mini 在物理模拟和编程能力上大幅提升,能生成四维空间内小球的弹射程序,并能快速克隆应用、生成游戏;Deep Research 是一个仅需提示即可创建研究分析师级别报告的代理。
- AI 发展尚处于早期阶段,从通用人工智能层面看,如 ChatGPT 仅属于 Level 1-Emerging 级别,但专业领域已有 AI 模型达到超人级别,如 AlphaFold、AlphaZero 等。
- AI 产业化将加速算力投入,推理市场有望快速放量,推动自动驾驶、人形机器人等领域发展,大模型厂商淘汰加速,无法超越开源模型的闭源厂商将快速出清。
- 投资建议关注 AI 产业链相关标的,包括工业富联、沪电股份、寒武纪、海光信息等 AI 云侧,以及蓝思科技、领益智造、鹏鼎控股等 AI 端侧公司。