长远来看,AI不仅提升生产力,还解放人类时间,而多模态AI视频将成为提供“精神养料”的关键。2025年9月发布的Sora2和10月发布的Veo3.1已实现原生多模态(理解生成结合),预计海外多模态将在2026年进一步迭代,通过统一视觉、音频、文本Token化向世界模型发展(不仅是生成视频,还包括理解预测物理变化)。国产大模型如字节Seed、Minimax 海螺有望快速追赶,预计2026年Q1实现追赶。
多模态技术直接受益者主要是AI视频和机器人/自动驾驶。AI视频受益于Sora2和Veo3物理一致性问题的解决,2025年Q4已进入生成环境(如AI漫剧),并有望随着国产多模态大模型在2026年Q1的追赶进一步加速。机器人/自动驾驶则有望在2026年随着世界模型(如谷歌genie3和特斯拉)的迭代在试验环境落地。
投资机会主要分为三个层面:
- AI视频:中长期看好平台和AI工具,相关标的包括字节跳动、Minimax、兆驰股份(风行)、昆仑万维、科大讯飞、阜博集团、万兴科技等。
- 机器人/自动驾驶:相关标的包括特斯拉、理想、小鹏汽车、小马智行、海天瑞声等。
- 算力/存储:有望持续受益于多模态、长记忆等技术的落地。