Tavus发布Sparrow-2模型:语音AI不再一停顿就抢话

Tavus发布Sparrow-2模型:语音AI不再一停顿就抢话

N
News Editor
2026-08-30 06:38:05
AI数字人公司Tavus推出实时对话理解模型Sparrow-2,通过每10ms更新对话状态,综合判断语气、停顿、说话人等上下文,解决语音AI抢话与漏答问题。实测显示其对话时机失败率仅2.1%,约为最佳对照模型的四分之一;面对用户超1秒停顿,97%情况会继续等待,且中位回复时间保持在680ms。

动察 Beating AI 快讯,AI 数字人公司 Tavus 推出实时对话理解模型 Sparrow-2,专门判断语音 Agent 现在该听、该等、该说,还是继续说。

它不再先把背景声音全部滤掉,而是把说话内容、语气、停顿、说话人、旁人声音和环境噪音一起判断,每 10ms 更新一次对话状态。这让它能处理很多传统语音 AI 容易翻车的场景。

你停几秒想下一句话,它可以继续等;你说一句「嗯哼」,它能判断是在鼓励 AI 继续说,不会立刻停下;旁边有人讲话,也不一定会被当成你在抢话。声音实在听不清,它会要求重说,而不是硬猜。

Tavus 在 575 个真实对话节点中测试 AI 会不会抢话或漏答。Sparrow-2 的对话时机失败率只有 2.1%,约为最佳对照模型的四分之一。

遇到用户停顿 1 秒以上思考时,它有 97% 的情况会继续等,不会误以为用户已经说完。这种「耐心」也不是靠单纯延迟回答换来的。Sparrow-2 和两个对照系统成功接话时,中位回复时间都是 680ms。

Sparrow-2 主要是更会判断什么时候该等、什么时候真的该开口。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
600

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。