智谱5.3 Flash版本作为登顶全球第一的大模型,其开源协议出现重大变化,通过激活参数压缩、层数削减等方式,优化了显存与带宽需求,性能全面碾压5.2版本,仅coding稍弱于自身5.3版本。此外,其原生多模态架构潜力巨大,大模型厂商通过分成协议盘活国内外算力量级市场。
智谱5.3 Flash可完全在10万张级国产芯片集群上运行,寒武纪当日完成适配,海光、浪潮信息等AI芯片及服务器龙头业绩近几个月翻倍。国模国芯正向互促的正循环正式启动,智谱官网服务已全部跑在国产芯片集群,端到端性能提升3倍,单TOKEN成本与主流英伟达GPU相当,数万卡级国产芯片集群部署头部大模型推理底座已验证可行。
智谱5.3 Flash的优化实现国产大模型与国产算力的精准互补,此前DeepSeekV4的优化也致力于降低显存带宽消耗。智谱官网服务已全部跑在国产芯片集群,端到端性能提升3倍,单TOKEN成本与主流英伟达GPU相当。产业链适配方面,寒武纪依托New Whale软件站完成适配,智谱收购中科院计算所背景的中科嘉禾掌控编译工具链,FLAG OS通过统一编译器和算子代码适配多家国产芯片,适配周期大幅缩短。
看好国产AI芯片及算力服务器行业,特别是寒武纪、海光、浪潮信息等龙头企业。相关业绩高增长仅为开端,国模国芯适配将进一步带动国产算力需求大幅提升。需重点跟踪各家大模型厂商的分成协议发布,关注数十万甚至数千亿美金级的AI商业化算力量级市场机会。
需关注智谱下一代模型性能的不确定性,其下一代模型(如基于5.3 Flash的大规格模型)是否能超过GPT-4仍存在不确定性。此外,国产芯片集群运行大模型的稳定性、成本控制仍需持续验证。