- 核心观点:AI技术长远看将解放人类时间,多模态AI视频将成为重要应用方向,2026年多模态技术有望进一步迭代并向世界模型发展。
- 技术进展:2025年9月发布的Sora2和10月发布的Veo3.1已完成原生多模态(理解生成结合),预计2026年海外多模态技术将统一视觉、音频、文本Token化,向世界模型进发,实现理解并预测世界物理变化。国产大模型如字节Seed、Minimax海螺有望快速追赶。
- 受益领域:多模态技术直接受益者主要为AI视频和机器人/自动驾驶。
- AI视频:受益于Sora2和Veo3物理一致性问题的解决,2025年Q4已进入生成环境(如AI漫剧),预计2026年国产多模态大模型追赶将进一步加速。
- 机器人/自动驾驶:随着世界模型如谷歌genie3和特斯拉的迭代,2026年有望在机器人、自动驾驶试验环境落地。
- 投资机会:投资机会主要在三个层面:
- AI视频:中长期看好平台和AI工具,相关标的为字节跳动、Minimax、兆驰股份(风行)、昆仑万维、科大讯飞、阜博集团、万兴科技等。
- 机器人/自动驾驶:相关标的为特斯拉、理想、小鹏汽车、小马智行、海天瑞声等。
- 算力/存储:有望持续受益于多模态、长记忆在内落地。