智谱Ox Alpha模型在参数规模上仅320B总参数、18B激活参数和45层,显著小于GLM-5旗舰模型,但超越GLM-5.2,Coding与Agent任务接近Claude Opus 4.8。此外,该模型在国产算力适配方面表现突出,匿名测试显示全部流量由国产芯片承载,验证了智谱全栈能力。
开源模型赛道正朝着更高性能与效率的方向发展。以智谱GLM-5.3 Flash为例,其在DeepSWE中输出Token减少63%仍得分约63%,Token效率与闭源模型相当,综合能力领先DeepSeek V4 Flash。价格方面,促销期输入/输出价格仅0.075/0.25美元/百万Token,约V4 Flash非高峰价格的1/3,常规价格仍更低,实际成本优势显著。架构创新如线性注意力与稀疏注意力混合架构、IndexPool和mHC等,在保持1M长上下文与多模态能力的同时,注意力计算量降低3.01倍,KV Cache降低4.44倍,实现了智力与效率的帕累托前沿。
报告重点分析了智谱Ox Alpha模型的参数规模与国产算力适配能力。Ox Alpha模型参数规模虽小但性能优异,超越GLM-5.2,Coding与Agent任务接近Claude Opus 4.8。在国产算力适配方面,该模型通过自研引擎、混合量化及EPD分离式架构,在国产芯片端到端服务性能提升3倍,硬件效率与单Token成本接近主流英伟达GPU,验证了智谱全栈能力。此外,报告还分析了GLM-5.3 Flash的性能效率与价格优势,以及智谱预训练Scaling与国产Infra能力。
当前开源模型市场正快速发展,智谱Ox Alpha和GLM-5.3 Flash等模型在性能与效率上取得显著突破。Ox Alpha模型参数规模虽小但性能优异,超越GLM-5.2,Coding与Agent任务接近Claude Opus 4.8。GLM-5.3 Flash在DeepSWE中输出Token减少63%仍得分约63%,Token效率与闭源模型相当,综合能力领先DeepSeek V4 Flash。价格方面,促销期输入/输出价格仅0.075/0.25美元/百万Token,约V4 Flash非高峰价格的1/3,常规价格仍更低,实际成本优势显著。这些进展表明开源模型在性能和成本上已具备竞争力,市场潜力巨大。
该研报提示,尽管智谱Ox Alpha和GLM-5.3 Flash等模型在性能和效率上取得显著突破,但开源模型市场仍面临技术成熟度、生态建设等挑战。此外,国产算力产业链的完善程度仍需提升,虽然智谱已验证国产芯片端到端服务性能提升3倍,但整体硬件效率与单Token成本仍需进一步优化。此外,市场竞争加剧也可能影响模型的应用推广。因此,投资者需关注技术迭代速度、生态建设进展及国产算力产业链的完善情况。