MiniMax H3模型具备三大核心能力:原生多模态理解与生成、多模态精准编辑与控制、商用级多场景内容生成。模型支持文本、图像、音频及视频输入,可生成原生双声道音视频,最高支持15秒、2K分辨率,定价约为0.53-0.82元/秒,低于主流模型三分之一。
H3围绕理解、生成与效率完成系统性升级:Contextual Omni Representation强化多模态Caption能力,支撑复杂指令理解;H3-VAE提升视觉信息压缩效率,支持2K视频生成;H3-Omni Transformer采用理解与生成异构架构,端到端训练吞吐提升近30%;In-context Regeneration结合上下文提升高清重生成能力。
MiniMax作为少数在文本(M3)、视频(H3)、语音及音乐领域持续投入的大模型厂商,H3进一步强化其全模态模型公司定位。分析师预计MiniMax2026-2028年收入分别为5.7、11.4、17.1亿美元,同比增长625.9%、99.3%、49.6%;Non-GAAP归母净亏损将逐步收窄。重申“买入”评级,认为H3将推动Hailuo产品增长,并为未来多模态融合与AGI演进奠定基础。
全模态AI赛道正朝着多模态融合与商业化落地方向发展。MiniMax H3以高性价比和开放生态策略切入市场,推动行业竞争格局变化。未来多模态模型将向更高效率、更强理解能力、更广应用场景演进,成为AGI演进的重要基础。目前行业仍处于早期阶段,头部厂商通过技术积累和生态布局抢占先机。
MiniMax H3研报提示的风险包括:模型迭代不及预期可能影响产品竞争力;行业竞争激烈可能导致价格战或市场份额被侵蚀;盈利改善不及预期可能影响估值水平。此外,数据合规和模型安全也是需要关注的长期风险因素。目前行业仍面临技术成熟度、商业模式验证等多重挑战。