豆包App于5月23日升级实时通话功能,新增视频聊天问答功能,用户可通过视频与豆包对话获取解答。该功能基于豆包视觉理解模型的重大升级,具备多模态信息融合处理、复杂任务处理及实时联网检索三大核心能力,实现从静态图像到动态视频的跨越。技术团队优化模型架构,将平均响应延迟控制在800毫秒内,并具备情境保持能力,为场景化AI交互筑牢基础。
相比传统AI助手一问一答的交互方式,豆包视频通话功能通过视觉信息的引入构建自然语境,降低了用户描述需求的门槛。据网经社数据,在博物馆场景中,用户提问准确率较纯语音输入提升40%;多模态交互令老年用户使用意愿提高65%。此次升级标志着AI交互的重大突破,未来有望催生更多创新交互方式与应用场景。
建议关注:
- 算力:寒武纪、海光信息、阿里巴巴、奥飞数据等
- Agent:金山办公、泛微网络、金蝶国际等
- 军工AI:品高股份、普天科技等
风险提示:AI技术迭代不及预期风险、经济下行超预期风险、行业竞争加剧风险。