腾讯混元Hy3发布,看好腾讯模型追赶与生态价值
核心观点
腾讯混元第三代大语言模型Hy3于2026年7月6日发布,采用MoE架构,总参数295B、激活参数21B,最大支持256K上下文长度。Hy3通过提升训练数据质量与多样性、扩大RL算力规模实现能力进阶,以更小参数尺寸达到比肩参数规模为其2-5倍的国内外旗舰模型的效果。Hy3已批量接入腾讯内部业务线,并以Apache2.0协议开源,面向全球开发者开放商用。
模型能力升级
- 智能体能力显著提升:在推理、智能体和长上下文任务上取得突破,具体指标如Agentic Coding任务中Terminal-Bench2.1从58.0提升至71.7、DeepSWE从0.9提升至28.0;Agentic Search任务中BrowseComp从67.1提升至84.2;Working Agent任务中SkillsBench从29.1提升至55.3、Hy-FinModelBench从26.6提升至69.0。
- 内部盲测领先:270位专家真实工作任务盲测中,Hy3得分2.67/4,高于GLM-5.1的2.51/4,优势集中在前端开发、数据与存储、CI/CD。
- 应用场景广泛:在软件开发、办公生产、金融建模、前端设计、游戏制作等生产力任务上进步显著,成为高性价比的可靠选择。
用户体验优化
- 工具调用稳定性提升:修复多项可靠性问题,工具调用成功率与错误恢复能力增强,跨架构泛化稳定。
- 幻觉率与知识准确性改善:幻觉率从12.5%降至5.4%,常识错误率从25.4%降至12.7%。
- 长对话能力增强:多轮测试问题率从17.4%降至7.9%,长对话基准MRCR得分从42.9%提升至75.1%。
定价与成本优势
Hy3 API输入价为1元/百万Tokens、输出为4元/百万Tokens,明显低于GLM-5.2、Qwen3.7-Max等主流模型。内部实测显示,Hy3正式版对比preview版本,办公Agent任务平均耗时缩短34%,任务成功率从72%提升至90%;高频办公场景中,文档任务Token消耗降低47.4%,制作PPT任务Token消耗降低49.0%,实际算力成本显著下降。
开源与业务结合
Hy3采用Apache2.0开源,上线GitHub、HuggingFace等社区,推动外部生态繁荣;同时已在WorkBuddy、元宝等十余项腾讯业务中深度应用,另有近50个业务排队接入,形成数据飞轮。
研究结论
看好腾讯混元模型向一线模型追赶,以及腾讯系AI产品的生态价值,有望带动腾讯叙事&估值修复。维持此前预测腾讯2026-2028年收入为8229/9000/9890亿元,Non-GAAP归母净利为2733/3057/3437亿元。给予腾讯目标价708港币,对应19x2027eP/E,维持“买入”评级。
风险提示
宏观经济波动;Agent进展及效果不及预期;行业竞争加剧;Agent商业化进展或不及预期等。