- 国产超节点进入系统级验证阶段:2026年Q2以来,联想、浪潮、华为等厂商密集发布超节点方案,中科曙光建成全国产卡十万卡AI超级群。中国移动集采6208张AI加速卡,华为昇腾384超节点累计部署超750套,标志着国产算力从单机柜产品向超大规模集群延伸,形成产品供给、公开采购、规模部署和云服务输出的完整链条。行业关注重点转向稳定交付、持续运行和降低单位Token成本。
- 中外超节点方案差异:海外市场,英伟达通过CUDA生态和NVLink/Blackwell平台构建垂直整合体系,单柜集成72颗Blackwell Ultra GPU,NVLink带宽达130TB/s;AMD Helios选择开放路线,通过OCP等标准连接72颗MI455X GPU,强调生态兼容。国内厂商则围绕自主生态和系统集成能力竞争,华为、阿里云依托自研芯片和云服务形成端到端方案,中兴、联想、浪潮等聚焦多元GPU适配和行业场景落地。
- 超节点加速落地原因:MoE模型专家并行增加GPU间数据交换压力,长上下文和高并发推高KV Cache容量,传统Scale-out网络扩展在大型集群中面临跨节点通信延迟和网络拥塞瓶颈。超节点通过高带宽、低时延互联整合加速卡为统一计算域,减少数据搬运和通信等待,提高GPU利用率。
- 互联网大厂超节点布局:阿里云磐久AL128单柜集成128颗真武M890,百度天池超节点以32张昆仑芯XPU实现一层全互连,火山引擎上线102.4T自研交换机。大厂布局超节点旨在扩充算力供给,提高自研芯片和集群利用率,降低模型训练及推理成本,并将内部能力转化为算力租赁、模型调用和企业AI服务收入。
- 投资建议:建议关注具备超节点产品研发、系统集成及规模交付能力的整机平台,以及国产算力芯片、高速交换芯片、高速连接器与液冷散热、电源配套等环节。
- 风险提示:行业竞争加剧,CSP资本开支及AI算力需求不及预期,客户验证和规模交付进度不及预期。