DeepSeek V4-Pro和智谱GLM-5.3均优化了Agent和编程类工具支持,提升大模型能力可通过工程优化、数据质量实现而非单纯提升参数规模。DeepSeek V4-Pro高峰时段输入输出定价分别为0.3元、27元,智谱GLM-5.3延续智能上限提升策略。DeepSeek V4-Pro对自有Agent环境依赖高,搭配自身Harness时代码质量、缓存率提升明显,第三方环境表现一般。智谱GLM-5.3在基础漏洞发现场景得分84.5%,代码能力较GLM-52大幅提升,与GPT-3不相上下。
国产模型厂商将通过工程优化、数据质量提升能力,预计6个月内或推出2-3万亿参数模型。模型提价或缓解大模型价格战担忧,利好后续国产模型发布及商业化。Agent范式兴起,相关有AIGC基因的AI应用公司值得关注。国产模型厂商将持续提升性能,预计下一代GLM-5.5将实现模型性能极致释放。
报告重点分析了DeepSeek V4-Pro和智谱GLM-5.3的产品更新、核心能力、测试表现及市场定价。DeepSeek V4-Pro对自有Agent环境依赖高,搭配Harness插件化程度高;智谱GLM-5.3延续B端优势,工程效率、防御性编程、安全能力提升明显。报告还分析了Z-Code工具的市场表现及开发者群体评价。
当前大模型市场存在价格战,国产模型厂商通过工程优化、数据质量提升能力,避免单纯提升参数规模。模型提价或缓解价格战担忧,利好后续国产模型发布及商业化。Agent范式兴起,相关AI应用公司值得关注。国产模型厂商持续提升性能,但部分产品在真实场景测试中表现有待提升。
报告提示DeepSeek V4-Pro在第三方环境的表现有待进一步验证。智谱GLM-5.3在接近真实场景的漏洞利用测试(Exploit Bench)上表现相对不足,尚未满足部分投资人的高预期。后续2-3万亿参数模型的发布时间与性能落地情况存在不确定性。国产模型厂商需持续提升工程优化、数据质量及真实场景测试能力。