1月26日,阿里发布Qwen3-max-Thining模型,总参数量超万亿(1T),预训练数据量高达36T Tokens,是目前阿里规模最大、能力最强的千问推理模型,并采用全新的Test-time Scaling技术,实现多轮自我迭代,从范式上追平GPTo3。
Qwen3更新标志着国产模型进入Agent范式,开启国内推理算力军备赛。根据国金计算机的观点,2025年海外AI变化将主要来自RL和Agent推理范式,2026年国内或将重演。
核心观点与关键数据:
- Agent范式影响: 推理Token消耗较Chatbot扩大4~15倍,部分场景甚至百倍以上。
- CPU瓶颈: Multi-Agent机制导致CPU调度任务大幅增加,CPU开销可能在通信打满前成为瓶颈。
- 存储需求: Agent范式下Token和上下文指数级增长,KV Cache需求大幅提升,推动KV从HBM卸载至DRAM/NAND。
研究结论:
建议重视阿里链软硬件以及国产CPU、算力、存储的发展。具体建议关注:
- CPU: 海光信息、中科曙光、禾盛新材、广合科技、兴森科技、深南电路、宏和科技。
- 国内算力: 寒武纪、东阳光、海光信息、协创数据、首都在线、大位科技、华丰科技、潍柴重机、欧陆通。
- 存储: 兆易创新、大普微、闪迪、铠侠、美光、SK海力士、中微公司、北方华创、长川科技。