Tavus推出实时对话理解模型Sparrow-2,专为语音Agent设计,可精准判断聆听、等待、插话或继续发言的时机。该模型不依赖滤除背景声音,而是综合分析内容、语气、停顿、说话人及环境噪音,每10ms更新对话状态。在575个真实对话节点测试中,Sparrow-2的对话时机失败率仅2.1%,约为最佳对照模型的四分之一;遇用户停顿超1秒思考时,97%情况会继续等待,且不牺牲响应速度,中位回复时间保持680ms。此技术有望显著提升语音AI交互的流畅度和自然度。
其他报道 (1条)