DeepSeek发布多款AI模型,性能行业领先且价格优势显著
核心观点:
DeepSeek近期发布多款AI模型(DeepSeek-V3、DeepSeek-R1、Janus-Pro),涵盖语言及多模态类型,性能表现行业领先,成本优势显著,推动国产算力与模型应用双向奔赴,助力AI产业快速发展和应用落地。
关键数据:
- DeepSeek-V3:671B参数,激活37B,14.8T token预训练,性能比肩GPT-4o、Claude-3.5-Sonnet,API定价每百万输入tokens 0.5元(缓存命中)/ 2元(缓存未命中),输出tokens 8元。
- DeepSeek-R1:性能对标OpenAI o1正式版,API定价每百万输入tokens 1元(缓存命中)/ 4元(缓存未命中),输出tokens 16元,蒸馏小模型(32B、70B)超越OpenAI o1-mini。
- Janus-Pro:文字转图像性能比肩DALL-E 3,结合优化训练策略、更大数据集和模型规模。
技术优化:
DeepSeek-V3通过FP8混合精度训练、DualPipe算法、跨节点通信优化等降低训练成本,每处理1T token仅需180K H800 GPU小时,总训练成本约557.6万美元。
开源与生态:
DeepSeek开源模型推动国产算力应用,硅基流动×华为云、腾讯云等平台支持部署,英伟达、微软、亚马逊等海外巨头接入,助力生态成熟。
产业链影响:
- 推理端:低成本重构驱动产业革命,端侧AI迎来黄金期,建议关注AIDC建设(润泽科技)、GPU算力(光环新网)、端侧AI(广和通)。
- 训练端:训练成本降低释放需求,短期GPU集群投资或受压,但长期仍看好训练算力需求,建议关注英伟达、博通及光模块(天孚通信、新易盛)。
- 国产算力:中国银行未来五年拟提供万亿金融支持,国产GPU、服务器等产业链受益,建议关注盛科通信、光迅科技等。
风险提示:AI需求不及预期、国产算力发展不及预期、国际贸易局势变化。