国内大模型发展存在两种路线:高端模型商业化与低价模型普惠化。高端模型如Anthropic的AR收入增速惊人,但定价昂贵;低价开源模型虽价格低廉,但调用量巨大,占比超过70%。国内厂商如DeepSeek、智谱等采用开源模式,通过旗下顶级模型打造品牌护城河,同时释放低价模型满足大众需求,并与云厂商合作。这种模式使国内厂商在Token调用量上占据全球领先地位。
低价模型虽满足用户需求,但难以直接为模型厂商带来高价值。模型厂商无法决定用户选择,用户倾向于通过第三方平台选择多模型。国内厂商应继续发展高端模型,同时通过开源模型吸引开发者和合作渠道,提升Token调用量。腾讯等大厂则利用生态和算力优势,通过低价模型和传统互联网打法抢占市场份额。
智谱5.2模型在长程任务和agentic coding方面取得突破,体现了其对下一代大模型任务的布局。智谱在智能体和任务执行方面表现突出,通过强化学习和后训练提升模型能力。MiniMax在模型训练架构上有所创新,但整体进度仍落后于国外厂商。
商业化方面,豆包通过C端订阅制和增值服务实现盈利,并探索与抖音生态结合。阿里因内部资源分散错失C端机会,未来将聚焦开发者、B端和电商领域。腾讯拥有强大产品开发能力,但模型卡量不足,商业化前景取决于其与微信的结合程度。
国内大模型发展潜力巨大,未来可能形成四五家领先厂商的格局。AGI方面,MiniMax和DeepSeek具备潜力,但整体进度仍落后于国外厂商。