总结
行业周观点
阿里千问AI平台上线Qwen3.8-Flash,训练成本约为Qwen3.7-Plus的九分之一,并在多项编程及办公任务评测中超越Qwen3.7-Plus和Claude Opus 4.6。智谱上线并开源GLM-5.3-Flash,是GLM-5系列首个原生多模态模型,综合能力超过GLM-5.2,API定价仅为GLM-5.3的十分之一,并通过视觉反馈强化前端开发、文档生成和专业办公任务中的自我检查及修改能力。阿里与智谱的模型升级强化了大模型进入生产流程所需的经济性和任务交付能力,为长文本处理、代码开发和高频Agent任务提供更具性价比的模型底座。GLM-5.3-Flash通过引入视觉反馈和输出自检能力,将模型的任务边界由生成代码或文档内容延伸至检查界面效果、验证操作结果并交付完整成品,有望提高复杂任务的完成率及输出可靠性。两者共同降低开发者和企业部署Agent应用的成本与门槛,并推动模型厂商通过API调用、开发工具订阅及金融、办公等行业解决方案扩大商业化收入。MiniMax发布2026年中期业绩公告,上半年实现收入1.17亿美元,同比增长283.1%,其中开放平台及其他基于AI的企业服务收入同比增长703.1%至7393万美元,占总收入的63.4%,AI原生产品收入同比增长100.9%至4264万美元。公司毛利率由上年同期的12.1%提升至17.9%,主要受益于基础设施效率改善;中国内地以外市场收入占比达到60.8%。同期公司研发开支同比增长138.8%至2.97亿美元,经调整净亏损同比扩大111.2%至2.93亿美元。MiniMax开放平台及企业服务收入快速增长并成为主要收入来源,反映开发者API调用、Token套餐及企业客户需求正在加快转化为收入,收入结构由主要依赖AI原生产品逐步拓展至面向开发者和企业的模型服务。公司海外收入占比较高,表明国产模型厂商具备通过全球化产品及开发者平台扩大用户覆盖的潜力;毛利率改善则初步体现推理基础设施效率提升对模型服务盈利能力的正向作用。公司研发投入仍明显高于收入规模,当前仍处于以高研发投入和算力支出换取模型能力、用户规模及市场份额的阶段,后续还需关注收入增长的可持续性以及推理成本优化、商业化进程推进对盈利能力的提升。中长期视角下,继续聚焦AI产业、数据产业两大投资主线。
市场行情回顾
申万计算机行业跑赢沪深300和创业板指,周涨跌幅位于申万31个一级行业的中下游。上周,沪深300下跌0.21%,创业板指下跌3.42%,申万计算机行业指数上涨1.38%,分别跑赢沪深300和创业板指1.59和4.80个百分点,在申万各一级行业中排名第20位。申万计算机行业2026年初至8月28日累计下跌14.76%,位于申万31个一级行业的中下游。2026年初至8月28日,沪深300下跌0.45%,创业板指上涨6.91%,申万计算机行业指数下跌14.76%,分别跑输沪深300和创业板指14.31和21.66个百分点,在申万各一级行业中排名第24位。行业估值水平低于历史中枢水平。从估值情况来看,申万计算机行业2026年8月28日PE-TTM为119.10倍,低于2023-2025年历史PE-TTM的均值158.59倍。
产业动态
3.1 AI大模型:腾讯混元Hy4 preview发布,稳居开源模型第一梯队
腾讯混元发布并开源新一代大语言模型Hy4 preview,总参数770B、激活参数49B,上下文长度突破1M,在代码、办公、科学等真实生产力任务上展现出卓越能力。Hy4 preview在模型尺寸、上下文长度、数据规模上都进行了显著的扩展,预训练和后训练的共同进步带来了智能水平的又一次巨大提升,稳居开源模型第一梯队。混元持续与CodeBuddy/WorkBuddy等产品深度协同,优化生产力场景的真实用户体验。
3.2 AI大模型:Qwen3.8-Flash上线千问AI平台
千问AI平台上线Qwen3.8-Flash,在编程、Agent等真实任务中达到极致性价比。最新价格如下:输入每百万Tokens0.8元,输出每百万Tokens2.7元,缓存命中每百万Tokens0.1元。Qwen3.8-Flash是一个多模态混合专家(MoE)模型,采用了下一代(Next)模型架构,千亿总参数仅激活60亿(6B),创下模型效率的全球新基准。模型采用了与此前所有千问大模型完全不同的全新架构:在注意力方面,引入独特的QSA(Qwen Sparse Attention)机制,形成与GDN高效融合的混合注意力架构,可显著降低计算开销,在高缓存命中的1M Tokens长上下文实际场景中可提速8倍以上;在模型内部分层通信方面,引入自研的GatedResidual方法,将传统Transformer的1条信息主通道拆分并拓展为4条,让模型可根据需求动态决定读写信息,信息传递更高效,训练也更稳定;在模型参数扩展方面,引入51B的N-gram Embedding参数,为模型Transformer参数提供更高效的查表寻址,在每次token计算时无需参与,以极少的资源消耗“外挂”了一个大规模的“记忆指南手册”,模型参数扩展效率更高;在模型调参方面,模型结构和后期优化协同进行,收敛效率和训练吞吐大幅提升。
3.3 AI大模型:谷歌推出Gemini Omni 1.1 Flash视频生成AI模型,最高4K分辨率
谷歌宣布推出Gemini Omni 1.1 Flash视频生成AI模型,最高可生成4K视频。新模型亮点如下:场景扩展,用户可以直接基于已有视频,从结尾处无缝衔接并继续生成后续画面。用户可按每次10秒的步长逐步扩展视频,单条视频的累计最长时长可达40秒;指定首尾帧,只需指定镜头的起始帧与结束帧,即可实现平滑自然的转场效果与镜头运镜;生成360p预览,相较于Omni 1.1的标准720p分辨率,生成速度最高可提升60%,且成本仅需原有的三分之一,适用于快速原型验证、分镜脚本迭代以及高速渲染;最高4K分辨率,可直接输出画质细腻、细节完善的高分辨率1080p或4K最终成片;视频参考,构建视频场景时,支持引入最长3秒的参考视频片段,从而依据参考内容精准维持画面的上下文背景与角色一致性。价格方面,Gemini Omni 1.1 Flash生成360p视频每秒0.03美元(现汇率约合0.2元人民币),生成720p视频每秒0.1美元(现汇率约合0.67元人民币),生成1080p视频每秒0.15美元(现汇率约合1元人民币),生成4K视频每秒0.3美元(现汇率约合2元人民币)。
3.4 AI大模型:MiniMax发布2026年中期业绩公告
MiniMax发布MiniMax M3,对核心模型产品进行了升级,进一步加强我们在编程、Agentic工作流程及专业工作等方面的能力。之后不久,我们亦发布具有开源权重的MiniMax H3,推进用于商业创作的视频生成技术,并拓宽企业部署与开发者创新的路径。随着推理及Agentic工作负载需求持续增长,开放平台服务的企业客户与开发者群体不断扩大,其对业务的推动作用亦逐渐增强。我们持续深化全球布局,以日益强大且具成本效益的智能产品,为230多个国家与地区的企业客户、开发者及个人用户提供服务。MiniMax发布2026年中期业绩公告,截至2026年6月30日止六个月,总收入同比增长283.1%,由30.4百万美元增至116.6百万美元,超过2025年全年79.0百万美元的总收入。开放平台及其他基于AI的企业服务收入同比增长703.1%,由9.2百万美元增至73.9百万美元,占总收入的63.4%,而2025年同期占比为30.3%。该增长乃归因于付费用户及企业客户数量增长、API调用量增加以及我们的Token计划迅速获采用。AI原生产品收入同比增长100.9%,由21.2百万美元增至42.6百万美元,主要得益于用户参与度提升、付费意愿增强以及海螺AI与其他AI原生产品持续商业化。
3.5 AI大模型:GLM-5.3-Flash,前沿智能进入普惠时代
智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。GLM-5.3-Flash的架构专为极低成本而设计,总参数量与GLM-4.5相当(355B vs. 320B),但激活参数量(32B→18B)与层数(92→45)几乎减半。结合智谱最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。GLM-5.3-Flash同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接(Manifold-Constrained Hyper-Connections,mHC)提升模型Scaling能力。
风险提示
中美科技摩擦;地缘政治风险;产业生态建设不及预期;应用落地不及预期;数据隐私安全风险;市场竞争加剧。