- Blackwell Ultra 发布:NVIDIA 发布内存增强版 Blackwell Ultra,单卡 Dense FP4 算力较 B200 提升 50%,HBM 配置升级至 288GB HBM3e,网络层面采用 ConnectX 8 网卡,预计 2025 年下半年出货。市场预期 GB300 采用“SXM Puck”形式及 BGA 封装设计未确认。
- Rubin 及 Rubin Ultra 产品路线图:NVIDIA 发布 Blackwell 继代产品 Rubin 和 Rubin Ultra,统一 GPU die 计数标准。Rubin NVL144 内含 144 颗 die(72 颗 Rubin 芯片),Rubin Ultra 单颗芯片整合 4 颗 die,NVL576 内含 144 颗 Rubin Ultra 芯片(低于预期 NVL288)。Rubin Ultra 采用纵向 Tray 结构,优化机柜空间,预计大规模 Scale Up 场景主流。产品节奏延迟约半年,首款 Rubin 产品推迟至 2026 年下半年,Rubin Ultra 推迟至 2027 年下半年,主要受制程、封装及机柜挑战。
- 硅光交换机平台:发布 Spectrum-X Photonics 和 Quantum-X Photonics 硅光交换机平台,单端口速率达 1.6 Tb/s,总带宽最高 400 Tb/s。Spectrum-X 提供 512 个 800 Gb/s 端口,Quantum-X 提供 144 个 800 Gb/s InfiniBand 端口,采用 200 Gb/s SerDes 技术,提升数据中心传输性能。
- 个人 AI 超算设备:发布 DGX Spark 和 DGX Station,推动 AI 超算向个人桌面端普及。DGX Spark 采用 GB10 Blackwell Superchip,128GB 统一内存,最高 4TB SSD,算力 1,000 TOPS,售价 3,000 美元。DGX Station 搭载 GB300 Blackwell Ultra Superchip,AI 性能 20 PFLOPS,784GB 统一内存。
- 开源推理服务框架 Dynamo:发布开源推理服务框架 Dynamo,运行 DeepSeek-R1 模型时请求处理能力提升 30 倍。性能提升源于解耦的 Prefill/Decode 阶段、动态 GPU 调度、LLM 感知请求路由、加速 GPU 间异步数据传输及 KV Cache 跨内存层级卸载机制。已开源并集成至 NVIDIA AI Enterprise 的 NVIDIA NIM 微服务。
- 风险提示:芯片制程发展与良率不及预期、中美科技领域政策恶化、智能手机销量不及预期。