您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [杰富瑞]:AI系列第55期:混元3正式版发布,Token趋势,锁仓到期 - 发现报告

AI系列第55期:混元3正式版发布,Token趋势,锁仓到期

信息技术 2026-07-06 杰富瑞 Franky!
报告封面

中国(中华人民共和国)| 互联网 AI系列第55期:Hy3正式版发布;代币趋势;锁仓到期 (1)腾讯发布Hy3版本,在成功率、成本效益、长时程任务等方面进行了进一步增强(例如)。API价格具有竞争力(参见图表4),以支持更多用户和场景;(2)Token消耗指数:6月28日当周保持疲软,低于5月水平;(3)OpenRouter:Token使用量与上周基本稳定;(4)智谱/MiniMax的锁仓期于本周到期;(5)新措施旨在保护用户免受AI虚拟亲密关系的影响。 在本报告中,我们为投资者提供了关于OpenRouter代币消耗的50余项数据点、不同模型的定价、人工智能分析中的模型智能、按子行业划分的用户趋势以及其他行业数据分析。 Hy3官方版本根据用户反馈进行了多项改进。Hy3与预览版本相比的主要亮点包括:(1) 收集了来自超过50个业务单元的反馈,并升级以提供更好的用户体验。在输入/输出价格方面,Hy3的收费为每百万个token人民币1元/人民币4元,而预览版本为人民币2元/人民币8元。旨在支持更多用户和场景;(2) 在后训练方面进行了进一步改进,例如强化学习(RL),如展示5所示。在长文本上下文中表现优于参数量多2-5倍的 large models;(3) 在生产力场景(如软件开发、办公、金融、设计和游戏开发)中创造价值;(4) 在真实工作场景中对270名专家进行的盲测显示,Hy3的得分优于GLM-5.1(例如前端、数据、存储、CI/CD);(5) 在以下方面的进一步改进:(a) 任务成功率更高(90% vs 之前的72%);(b) token效率:与GLM-5.2相比,在文字处理(节省47.4%)和PPT(节省49%)中实现了token消耗的节省;(c) 幻觉减少15个百分点。请参考不同第三方评估的展示6。 硅基数据大语言模型代币消耗指数:6月28日当周显示持续疲软。该指数(见附表2)的权重根据使用集中度进行分配(例如,当需求转向高端模型时,消耗会增加)。另一方面,媒体报道(如《信息参考》、《经济观察》)指出,科技和互联网公司对员工设置了代币消耗的上限。根据我们的核查,该指数在6月28日至7月4日期间介于1.62至1.71(对比6月21日至27日的1.68至1.74),而5月31日为2.04。基于人工智能分析,中国模型DeepSeek、Qwen、Kimi、MiniMax和Zhipu相较于美国模型具有高度成本效益,API成本仅为美国模型的一小部分(见附表3),这得益于前者精妙的架构,如专家混合(MoE)、注意力机制(组查询注意力GQA、稀疏注意力)和模型浮点运算利用率(MLU)。 OpenRouter:与上周相比,令牌消耗保持稳定。根据对6月29日(与6月22日)一周的分析(见附表1),每周消耗的令牌数量保持在46.7万亿个。在排名方面,DeepSeek V4 Flash排名第一,其次是小米MiMo-2.5和MiniMax M3。 DS-V4和Seedance 2.5将于7月发布。根据我们最近的更新(链接)和(链接),DS-V4将从7月15日起实施新的定价策略,在高峰时段(上午9:00至中午12:00,下午2:00至6:00)将输入/输出价格翻倍(参见图表7-9)。我们认为,在人工智能需求上升和供应受限的背景下,高度成本效益的模型至关重要。另一方面,视频生成模型Seedance 2.5预计即将发布,其升级包括:(a)30秒视频生成;(b)最多支持50个多模态输入资产;(c)视频编辑和生成功能的升级将提高效率和品质。 852 3743 8016 | thomas.chong@jefferies.com托马斯·钟 * | 股权分析师 852 3743 8163 | zoey.zong@jefferies.com宗子 Zoey * | 股票分析师 续页... 自8月1日起,将不再免费提供来自阿里云和腾讯云的更多产品。阿里云:Databridge Agent(DTS)将从8月1日开始商业化。它连接各种主流数据库,执行数据分析、安全防护及与AI生态系统的集成; 美团发布开源LongCat 2.0模型。亮点包括:(1) 总参数量1.6万亿,动态激活范围在330亿至560亿token之间;(2) 1百万上下文长度;(3) 通过LSA(LongCat稀疏注意力LSA)实现高度成本效益;(4) 计算层面高度动态化,采用Zero-computation专家+ScMoE技术;(5) 在代理、推理和交互环节使用国产计算资源;(6) 首个在此规模下完成完整训练与推理的50K卡国产计算集群模型;(7) 在SWE-bench Pro(软件工程)和Terminal-Bench(代理)基准测试中表现优于同类模型。 WorkBuddy 在 Workspace Agents 市场中处于领先地位。根据第三方分析机构的数据,它突出了WorkBuddy 在该细分市场(2026年3月)的运营指标。这些指标包括:(1) 桌面月访问量达到 885万;(2) WorkBuddy 领先于 Trae(字节跳动)、QClaw(腾讯)和 Qoder Work(阿里巴巴)。 相关当局实施措施以规范拟人化服务。该措施于2026年4月由中国互联网信息办公室、国家发展和改革委员会、工业和信息化部、公安部和国家市场监督管理总局发布。该措施将于7月15日实施,旨在(1)保护用户免受虚拟亲密关系服务(例如虚拟亲属或虚拟伴侣)引发的问题;(2)避免过度依赖人工智能并影响现实的人际关系。我们已经看到抖音和智谱将分别于7月15日和7月10日停止提供这些功能。 贝塔、金山、人工智能实验室和克林是受益者。我们预计,随着对人工智能模型和代理的需求增长,代币消耗将激增,从而将使百度、阿里巴巴、腾讯(贝塔)、金山云(金山)、人工智能实验室和克林等CSP(云服务提供商)受益。根据Artificial Analysis的分析:(1)中美模型的智能差距正在缩小;(2)与受益于MoE(摩尔定律)、线性注意力和MFU(多任务处理单元)的美国相比,API成本只是其中一小部分;(3)编码、工作区场景以及中长篇内容在未来应看到巨大的机遇(参见图表85-89)。 中美对比 人工智能模型 根据OpenRouter的数据,Coding/Agents的日益普及以及高性能、高性价比的中国模型的推出,正在推动着token的消耗。 根据OpenRouter的数据,由于(a)编码/代理的使用激增,导致2月26日的token消耗显著上升。这使得人们使用AI从“聊天”扩展到“工作”。它连接大型模型,这些模型可以本地部署或部署在服务器上,允许您通过自然语言聊天自动化工作流程;(b)发布了一系列高性能且成本效益高的模型,包括Kimi 2.5(1月26日)、M2.5(2月26日)和GLM-5(2月26日)。 根据OpenRouter(6月29日至7月5日期间)的数据,中国模型的token使用量较上周增加了14.9%,达到2340亿。这与美国模型的430亿token使用量形成对比。DeepSeek V4 Flash的每周token使用量正在快速增长。 在OpenRouter中,中国模型在6月29日那一周在token消耗方面超过了美国模型。 在公司的代币消耗方面,谷歌(28.2%)位居第一,其次是DeepSeek(20.5%)、OpenAI(16.2%)、Qwen(5.8%)和Anthropic(5.2%)。按模型计算,每周代币消耗排名前五的是DeepSeek V4 Flash(5.34万亿)、MiMo V2.5(4.38万亿)、MiniMax M3(4.11万亿),随后是Hy3预览版(3.13万亿)和GLM 5.2(2.58万亿)。 深Seek V4 Flash在排名中位居第一6月29日那一周的交易量 基于人工分析,中国模型DeepSeek、Qwen、Kimi、MiniMax和Zhipu正在缩小与美国的差距。与美国模型在智能方面的差距相比,中国模型在混合模型方面具有极高的成本效益。在输入方面... 专家模型(MoE)架构、线性注意力机制和模型算力利用率(MLU)。根据2026年斯坦福人工智能指数报告(2026年4月),美国顶尖模型领先中国模型2.7%。此外,截至2026年3月26日,Anthropic(1503)、xAI(1495)、Google(1494)、OpenAI(1481)、阿里巴巴(1449)和DeepSeek(1424)位列Arena Elo评分体系的第一梯队。 输出API,中国大型模型效率远超美国模型。 源自:Artificial Analysis,Jefferies第16项 - 人工智能与混合定价 就输入/输出API价格而言,中国模型的费用只是美国模型的零头。 源自:Artificial Analysis,Jefferies 截至7月6日,在排名前20的大型模型中,有8个是中国模型,并且是开放权重的。 公司输入/输出价格模型 源自:Artificial Analysis,Jefferies 人工智能分析,杰富瑞研究笔记:>512k输入token的MiniMax-M3 源自:Artificial Analysis,Jefferies 源:Artificial Analysis,Jefferies笔记:32k < 输入token数 <= 128k 源:Artificial Analysis,Jefferies笔记:32k < 输入token数 <= 128k 模型定价趋势 视频生成模型服务 红色表示本月价格上涨/新价格 开爪 根据OpenRouter的数据,MiniMax M3、DeepSeek V4 Flash和Owl Alpha在OpenClaw上的token消耗量排名前三。 根据OpenRouter的数据,OpenClaw基于token消耗量排名前三的模型均来自中国,分别是MiniMax M3、DeepSeek V4 Flash和DeepSeek V4 Pro。其他模型还包括MiniMax M2.7、MiMo V2.5 Pro和Kimi K2.6。 根据PinchBench的数据,Anthropic的Claude Opus 4.8 Fast在成功率方面排名第一(93.5%),其次是Qwen3.7 Max(92.5%)和Claude Opus 4.8(90.5%)。 在中国市场,Qwen3.7 Max(92.5%)排名第一,其次是MiMo V2.5(89.7%),然后是Qwen3.6 Flash(88.1%)和MiMo V2.5 Pro(87.5%)。 AI 助手 多家领先企业的DAU在5月份环比有所增长。 • 月度趋势:Qwen的用户月活跃数(DAU)5月份达到2790万(对比4月:2920万),余额宝达到880万(对比4月:900万)。抖音的用户月活跃数环比增长5%,达到1.58亿(对比4月:1.51亿)。DeepSeek的用户月活跃数环比增长约6%,达到约3050万。 视频生成模型 根据人工分析(截至6月29日),HappyHorse-1.1和HappyHorse-1.0在文本转视频和图像转视频方面排名前五。其他还包括Seedance 2.0 720p、Wan 2.7、SkyReels V4、Kling 3.0 1080p(专业版)和grok-imagine-video。 全球及中国AI手机应用月活跃用户排名 根据 aicpb.com 的信息,由于春节因素,中国 AI 应用的月活跃用户数(MAU),包括抖音、Qwen、Quark 和 Yuanbao,在 2 月份相对于 ChatGPT 经历了强劲的环比增长。 在国内市场,Qwen的月活跃用户数(MAU)在6月份实现了环比快速增长。 5月26日:QuestMobile分析月度应用追踪器 网上购物 拼多多在5月份实现了年同比增长的快速日活跃用户增长。 • 月份趋势:淘