DeepSeek于2026年4月24日发布并开源全新大模型产品DeepSeekV4预览版,核心亮点为1M超长上下文能力,同时在Agent交互、世界知识储备与推理性能上实现全面领先。
DeepSeek发展史梳理:
- 2023年11月发布首个开源代码大模型DeepSeekCoder和通用大模型DeepSeekLLM67B。
- 2024年1-5月发布开源MoE模型DeepSeekMoE和DeepSeek-V2,大幅降低AI使用成本。
- 2024年6-8月发布代码能力超越GPT-4Turbo的DeepSeekCoderV2和DeepSeek-Prover-V1.5数学推理模型。
- 2024年12月发布通用模型DeepSeek-V3,训练成本仅550万美元,性能对标国际闭源模型。
- 2025年1月发布第一代推理模型DeepSeek-R1-Zero和DeepSeek-R1。
- 2025年8月发布DeepSeek-V3.1和DeepSeek-V3.2,分别支持智能体工具调用和百万级超长上下文能力。
- 2026年4月24日发布DeepSeekV4预览版并同步开源。
DeepSeek模型架构创新:
- DeepSeekV4包含两款MoE模型:DeepSeek-V4-Pro(1.6万亿参数,主打高性能研发)和DeepSeek-V4-Flash(2840亿参数,主打轻量化、低成本落地)。
- 融合CSA与HCA混合注意力架构,显著降低长上下文推理显存占用,大幅提升推理吞吐量。
- 在1M上下文长度下,V4-Pro单Token计算量仅为前代V3.2的25%,KV缓存占用进一步降至10%。
DeepSeekV4Pro性能:
- Agent能力显著增强,在AgenticCoding评测中位列开源模型第一梯队。
- 拥有完备的世界知识储备,在专项测评中大幅领先同类开源模型。
- 聚焦自主编程、工具调用、数学及STEM等高阶复杂任务,基准测试表现突出。
- 编程能力是本次迭代提升的亮点,在SWE-bench Verified、LiveCodeBench、TerminalBench2.0评测中表现优异。
- API价格优势显著,输入、输出原价分别优于同定位1M上下文商用模型ClaudeSonnet4.6。
国产算力厂商适配:
- DeepSeekV4已在NVIDIA GPU与华为昇腾NPU双硬件平台完成EP方案落地验证。
- 昇腾平台适配落地尤为亮眼,4月24日即完成全系列Day0适配,实现低时延和高吞吐场景的推理。
- 寒武纪、摩尔线程、沐曦股份、海光信息等国产算力厂商相继完成DeepSeek-V4系列模型的适配与部署。
研究结论:
- DeepSeekV4模型实现超长上下文、推理及Agent能力全面升级,叠加CSA/HCA混合注意力架构带来显著成本与性能优势。
- 国产算力厂商完成快速适配,芯模协同生态持续完善,有望带动AI大模型及国产算力产业链需求加速释放。
- 建议关注国产AI芯片产业链的投资机会。
风险提示:
- 技术迭代不及预期风险。
- 商业化落地放缓风险。
- 行业竞争加剧风险。