美国最新一轮芯片出口管制可能暂时遏制了深度求索(DeepSeek)的发展势头。据中国主要云服务商员工透露,由于国内英伟达服务器芯片短缺,备受期待的下一代大语言模型 R2 在中国可能无法像其前代爆款 R1 那样快速广泛落地。美国近期针对中国市场设计的英伟达 H20 芯片实施禁令,进一步加剧了芯片短缺状况。
深度求索公司尚未确定 R2 模型的具体发布时间,尽管工程师们过去几个月一直在全力开发,但 CEO 梁文峰对新模型的性能仍不满意。公司工程师正在完善 R2,直到梁文峰批准发布为止。若 R2 在发布时性能超越现有开源模型,中国云服务商将面临巨大需求压力,这些企业本就因英伟达芯片短缺而捉襟见肘。
深度求索的模型完全针对英伟达硬件和软件进行了优化,使用中国芯片运行这些模型更难管理且效率更低。华为技术等中国芯片开发商提供了英伟达芯片的替代品,但效果不及英伟达芯片。美国出口管制导致英伟达 AI 芯片供应受限,今年早些时候 DeepSeek 的 R1 模型需求激增时,中国就已面临挑战。为填补缺口,许多国内企业转而使用英伟达为游戏设计的芯片(如 RTX 5090 和 RTX 4090)来运行 R1。
为满足 R1 的需求,包括字节跳动、阿里巴巴和腾讯控股在内的科技巨头在 2025 年前三个月订购了价值 160 亿美元的英伟达 H20 芯片——总计 120 万片。相比之下,据 SemiAnalysis 估计,去年英伟达向中国出货的 H20 芯片仅为 100 万片。四月的禁令彻底粉碎了云服务企业囤积更多 H20 芯片的希望。
尽管深度求索尚未确定 R2 的发布时间,但该公司已与部分中国云厂商保持密切沟通,向其提供技术规格以指导服务器托管和模型分发方案。这些计划包括为需要使用完整版 R2 的客户筹备足量 H20 芯片。目前最好的选择是依赖中国现有的 H20 芯片库存,但这可能会限制企业使用 R2 的程度。中国境外的公司可以更轻松地使用 R2,因为它们不受相同的芯片限制。