核心观点与关键数据
- Veo3模型发布:谷歌在2025年5月21日I/O开发者大会上发布新一代视频生成模型Veo3,引发业内广泛关注,其生成视频在X上迅速出圈。
- 技术突破:Veo3在人物刻画、光影效果、微表情与场景交互、声音与口型同步、复杂物理现象理解及长视频连贯性等方面实现显著提升。
- 对比Veo2及其他模型:Veo3参数量较Veo2高出一个数量级,核心差异在于将音频数据纳入训练,并有效利用海量视频数据进行高阶段训练。
- 成本分析:Veo3预训练阶段消耗大量计算资源,后训练与推理阶段成本清晰,生成8秒视频单次成本约3美元,未来大规模应用需降低推理成本。
研究结论
- 里程碑意义:Veo3可能相当于自然语言处理领域的GPT3时刻,标志着视频生成技术从实验性向实用性跨越的关键节点。
- 行业影响:Veo3可能对内容创作领域产生结构性变革,引发对“真实视频”定义的重新审视,并推动AI视频生成技术向大众化应用场景渗透。
- 竞争格局:未来大厂在多模态大模型训练领域的竞争将加剧,视频数据或将成为核心门槛,缺乏海量高质量数据的参与者可能落后。
- 降本路径:国内团队可通过GPU降压运行优化、空闲计算单元精细化调度、底层架构与算子深度优化等技术实现成本控制,性价比优势显著。
- C端应用市场:随着应用成本下降,C端用户对视频生成模型的使用场景将呈现爆发式拓展,涵盖教育、游戏、娱乐、短剧等领域。
投资建议
- 长期关注:建议投资人长期关注应用方向,尤其是视频模型与Agent领域,预计将成为今年行业变革的关键方向。
- 投资标的:坚定看好AI大模型、应用相关标的,及巨头产业链标的,推荐港股的腾讯控股、阿里巴巴-W、快手-W等;A股的昆仑万维、焦点科技等。
风险提示