本周观点
DeepSeek V4发布:重视技术革新下Coding等领域能力提升
- DeepSeek V4系列大模型(V4-Pro和V4-Flash)在Agent能力、知识储备、推理性能等维度达到开源模型第一梯队水平,部分指标比肩全球顶级闭源模型。
- V4-Pro在Agent能力、知识储备和推理性能方面表现突出,其中Agent能力为当前已公开开源模型中Agentic Coding评测最佳水平。
- V4-Flash在知识储备稍弱于Pro版本,但推理能力与Pro版本接近,API调用速度更快、成本更低。
- DeepSeek V4开创了全新的注意力机制,实现了全球领先的长上下文能力(百万字),并大幅降低了对计算和显存的需求。
- DeepSeek V4针对主流Agent产品进行了适配和优化,在代码任务、文档生成任务等方面表现均有提升。
“模算协同”实现全国产闭环,国产算力迎来全新发展机遇
- DeepSeek V4将细粒度专家并行方案同时在英伟达GPU和华为昇腾NPU上完成验证,在通用推理任务上实现1.50 ~ 1.73倍的加速,在强化学习场景中最高加速比可达1.96倍。
- 昇腾超节点系列产品全面支持DeepSeek V4,在低时延、高吞吐、低成本等方面表现出色。
- 昇腾CANN推出的PyPTO编程范式,使开发者能够以符合Python习惯的语法进行算子开发,大幅缩短算子开发周期。
- 寒武纪基于vLLM推理框架,完成DeepSeek V4两款开源大模型的Day 0适配,实现业界领先算力利用率。
- DeepSeek开源模型推动“算法-芯片协同进化”,国产算力自身价值有望持续提升。
投资建议
- 建议重点关注:国产AI芯片/CPU(寒武纪、海光信息等)、国产超节点龙头(浪潮信息、中科曙光等)、云计算(金山云、网宿科技等)、AI编程(卓易信息、普元信息等)。
风险提示