华为推出UB Mesh架构,旨在解决AI大模型训练中面临的大规模、高带宽、低成本和高可靠性挑战。UB Mesh采用nD-FullMesh拓扑结构,通过逐层递归扩展实现灵活的多维空间聚合,信号传输开销显著降低。与传统Clos架构相比,nD-FullMesh在性能相近的情况下,大幅降低交换机和光模块成本,提高系统可靠性。
UB Mesh通过统一总线Unified Bus实现多组件互连与资源动态池化,支持NPU、CPU、交换机等硬件模块的灵活配置和资源池化,消除协议转换开销,简化驱动程序和通信库设计。4DFullMesh支持千卡集群,通过Clos拓扑可扩展至8000卡集群,满足大规模LLM训练需求。
在相同训练基准下,UB-Mesh较Clos架构实现2.04倍的成本效益提升,网络基础设施成本比例从67%降至20%,运营成本降低35%。华为正筹备基于中芯国际6nm工艺的昇腾920系列芯片,单卡算力超过900TFlops,内存升级至HBM3。CloudMatrix 384超节点提供300PFlops计算能力,硅基流动运行的DeepSeek-R1单卡Decode吞吐突破1920 Tokens/s。
产业链相关公司包括中芯国际、华丰科技、南亚新材、芯碁微装、深南电路、兴森科技、欧陆通。风险提示包括供应链波动、下游需求不及预期和行业竞争加剧。