DeepSeekV4发布后连续两轮降价,百万token成本击穿全球大模型定价底线
- DeepSeekV4预览版本上线,包含Pro和Flash两个版本,均原生支持100万token上下文长度,性能与ClaudeOpus4.6、人类顶尖选手持平。
- 发布次日,V4-ProAPI开启限时2.5折优惠;26日晚全系列API输入缓存命中价格降至原价的1/10,Flash降至0.02元/百万Tokens,旗舰款降幅高达97.5%。
- 胡延平指出DeepSeek压低行业价格预期,高盛认为其以更低成本支持复杂智能体应用,打开AI规模化空间。
技术架构实现极致降本,国产算力首次参与训练侧适配实现里程碑突破
- 技术维度:首创CSA与HCA交替的混合注意力架构,Pro版本单token推理FLOPs降为前代的27%,KV缓存占用降至10%;Flash版本更分别降至10%和7%。
- 国产算力适配:DeepSeekV4-Flash首个公开说明训练侧使用国产算力的通用大模型,通过MXFP4量化感知训练、TileLang底层算子、MegaMoE2融合内核设计,脱离CUDA生态,已在华为昇腾平台适配跑通。
- 中国信通院已启动DeepSeekV4国产化适配测试工作。
相关上市公司
- 浪潮信息:全球领先AI服务器厂商,推出专为DeepSeek优化的推理一体机产品(如NF5688M6),支持私有化AI应用,市占率中国前列,与多家国产芯片厂商完成适配。
- 海光信息:国内领先国产AI芯片设计厂商,DCU产品线全面覆盖各类大模型需求。