“海河·谛听”言语交互大模型是天津大学与慧言科技合作研发的,旨在解决数字智慧言语交互的主要挑战,包括语音模型、通用大模型和语音/文本单模态模型的不足。该模型借鉴神兽“谛听”可听人心的寓意而命名,通过深度理解言语意图,支持NVIDIA和国产化架构,以大模型为基础实现言语意图的深度理解。该模型基于天津市人工智能计算中心打造自主可控言语交互意图理解大模型,并在通用语音大模型算法团队、慧言科技算法/工程化团队的支持下,采用ModelArts的语音预训练框架,开发出新型通用语音预训练框架。该模型能够大幅提升声纹识别性能,并在其他任务上保持优越的效果。