光合组织人工智能创新大会:全球密度最高超节点,自研网络芯片对标海外龙头
核心观点与关键数据
超节点&超集群密度全球最高,硬件系统实力领先
- 单机柜性能指标:
- 卡数量:640卡,全球密度领先(NVIDIA 72卡,谷歌64卡)
- 算力(FP16):630PFLOPS,为国内领先384卡超节点的2.1倍
- 供电:860kW,能量密度领先(GB200 NVL72满载功率120kW)
- 量产技术领先:
- 400V/800V HVDC供电方案,进度领先(海外后续产品有望采用)
- 相变浸没式液冷,PUE 1.04,全球领先(冷板式通常1.1左右)
- 万卡超集群:
- ScaleX万卡超集群仅需16个X640机柜(8个双机柜组),算力5 EFLOPS(5*10^6TFLOPS)
自研网络芯片性能超越海外龙头
- ScaleFabric技术:
- 自研ScaleFabric性能超越IB,自研400G交换芯片,交换容量超越博通TH5
- 自研芯片交换容量:64T,超越博通TH5的51.2T,交换延迟相当于主流RoCE网络一半
- SerDes IP:
- 自研112G SerDes IP,驱动能力业内领先
- 柜内互联架构:
- 640卡采用正交架构全电互联,节约光模块成本,降低故障率
- 通信接口支持:
HSL总线持续演进,全面支持国产算力生态
- 技术演进路线:
- 25Q3 HSL标准发布,25Q4 HSL1.0规范发布,26Q1 HSL IP&参考设计发布
- 当前海光CPU已支持
- 生态支持:
- 支持CPU-GPU互联(类似NVIDIA GB/GH互联)
- 支持GPU间互联(对标NVLink/UALink)
- 市场预期:
- 预计2027年基于HSL的国产超节点全面上市,近期上市的几家国产GPU公司全线支持