核心观点与关键数据
- DeepSeek V3.1发布:深度求索发布开源模型DeepSeek-V3.1,采用混合推理架构,分为非思考模式(deepseek-chat)和思考模式(deepseek-reasoner),上下文扩展至128K。
- 性能表现:在Aider编程基准测试中得分71.6%,超越Claude Opus 4;SVGBench测试中仅次于GPT-4.1-mini;MMLU多任务语言理解得分达88.5%。
- 思维链机制:通过Post-Training优化提升Agent能力,相同性能下输出token减少20%-50%,降低推理成本。
- API价格优势:单次编程任务仅需1.01美元,为专有系统的1/60;输入价格0.5元/百万tokens(缓存命中),4元/百万tokens(缓存未命中);输出价格12元/百万tokens。
- 国产芯片设计UE8M0 FP8:推出8位指数、0位尾数的FP8精度格式,具备更低带宽、功耗和更高吞吐优势。
- 优势:相同硬件下显存需求降低75%,适合微缩放场景,减少量化误差,降低数据中心运营成本。
- 生态支持:寒武纪MLU370-S4、思元590/690系列等国产芯片已支持FP8;海光、沐曦等厂商亦有支持;华为昇腾路线图明确2025Q4原生FP8。
- 意义:代表国产AI走向软硬协同,减少对国外算力依赖,提升国产芯片竞争力。
- 投资建议:
- 关注领域:国产算力(寒武纪、浪潮信息等)、AI Agent(鼎捷数智、科大讯飞等)。
- 风险提示:技术发展不及预期、供应链与贸易风险、政策落地不及预期。
研究结论
报告强调DeepSeek V3.1在性能和成本上的优势,以及国产芯片通过FP8精度设计推动AI软硬协同进展,认为国产AI算力正加速追赶,建议关注相关产业链投资机会。