智谱Ox-Alpha模型在OpenCode和OpenRouter上测试时迅速成为最受欢迎模型,创双平台调用量新高。GLM-5.3-Flash参数量达320B,能力超过GLM-5.2,AA综合智能指数57分,进入全球前沿区间,与Claude Opus 4.8持平;Z.ai Code Bench编程体感与Opus 4.8相当。它是首个原生多模态模型,能自主判断何时用视觉反馈指导行动。
GLM-5.3-Flash定价仅为GLM-5.3的1/10,限时折扣内为1/20,为Claude Opus 4.8的1/40。模型总参数量与GLM-4.5相当,激活参数18B(GLM-4.5为32B)、层数45(GLM-4.5为92),几乎减半;30T Token多模态预训练。采用稀疏注意力+线性注意力混合架构,引入IndexPool降低1M上下文开销。
过去一周匿名测试的免费服务全部由国产芯片集群承载,硬件效率和单token成本已达主流英伟达GPU相当水平,验证国产芯片在大规模场景下的高效经济性。这为未来推理放量奠定基础,显示国产算力在AI推理领域的潜力。
报告指出市场对LLM观点出现分歧,但强调智谱模型能力领先,融资落地后算力规模持续扩大,将提升ARR增长预期及能见度。这反映AI行业竞争激烈,但国产大模型厂商通过技术创新和算力优化仍具优势。
研报提示行业应用进展不及预期为潜在风险。尽管智谱模型能力突出,但LLM的商业化落地仍面临挑战,如应用场景拓展、用户付费意愿等,这些因素可能影响公司业绩增长。