华为于全联接大会2025上发布昇腾AI芯片未来三年详细产品规划,并推出算力超节点和集群,正式拉开国产算力与英伟达在高端AI市场的竞争序幕。
昇腾AI芯片路线图:逐年升级加速追赶
- 昇腾910C已推出,后续将按计划推出昇腾950PR(26Q1)、昇腾950DT(Q4)、昇腾960(27Q4)、昇腾970(28Q4),每年1-2次全新升级。
- 三代昇腾芯片搭载自研低成本HBM技术,核心指标升级:
- 算力:950系列达1PFLOPS(FP8)/2PFLOPS(FP4),960与970系列算力翻倍。
- 互联带宽:950系列达2TB/s,960与970系列分别升级至2.2TB/s、4TB/s。
- HBM容量与带宽:950PR为128GB/1.6TB,950DT为144GB/4TB/s,960与970系列分别达288GB/9.6TB/s、288G/14.4TB/s。
- 从950系列起全面支持SIMT架构,与NVIDIA GPU实现高效并行计算;均支持MXFP4数值类型。
- 国产AI算力芯片跻身世界一流方阵,与国际产品演进全面接轨。
超节点成为AI基础设施建设新常态
- 超节点成为主导性产品形态,华为将推出Atlas 950 SuperPoD(8192张卡,27Q4上市)和Atlas 960 SuperPoD(15488张卡,28Q4上市)。
- 核心技术:
- 全光互联:柜间全光互联,高可靠、高带宽、低时延。
- 正交背板:零线缆电互联,液冷可靠性提升1倍。
- 互联协议灵衢2.0及UB-Mesh。
- 相比英伟达NVL144(明年下半年上市)和NVL576(2027年上市),Atlas 950超节点在卡规模、总算力、内存容量、互联带宽等均领先。
超节点速率与功率挑战
- 单机柜功耗普遍突破100kW,对温控和电源系统提出挑战,Atlas 950 SuperPoD采用全液冷。
- 互联带宽达16.3PB/s,FP4算力达16EFlops,训练性能4.91M TPS,推理性能19.6M TPS,速率大幅提升。
投资建议
- 建议关注芯片+HBM(中芯国际、通富微电等)、超节点相关(全光互联:德科立、腾景科技等;正交背板:深南电路等)、液冷温控(申菱环境、飞荣达等)。
风险提示
- AI需求不及预期;AI资本开支不及预期;AI产品迭代不及预期。