字节跳动发布SeedRealtime 原生音视频全双工大模型落地豆包

字节跳动发布SeedRealtime 原生音视频全双工大模型落地豆包

N
News Editor
2026-08-05 04:53:00
字节跳动正式推出原生音视频全双工大模型SeedRealtime,采用统一架构原生融合音频、视频与文本,支持在连续多模态信息流上实时交互。端到端人工评测显示,相比级联模型,其对话节奏问题减少一半,抢断、迟缓回应、误触发等卡壳现象显著减少,单次对话顺畅完成概率明显提升。该模型已在豆包App全量上线。据财联社报道,PANews 8月5日消息。

PANews 8月5日消息,据财联社报道,字节跳动正式推出原生音视频全双工大模型SeedRealtime。该模型采用统一架构,原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。

端到端人工评测结果显示,相比级联模型,SeedRealtime的音视频对话节奏问题减少了一半——模型对说话时机的把握更加自然,“话未说完被抢断、话音已落却回应迟缓、或是被背景杂音与闲聊误触发”等卡壳现象显著减少;同时,单次对话能够完整、顺畅交流的概率也有明显提升。

目前,SeedRealtime已在豆包App全量上线。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
700

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。