SeedRealtime 是什么

8月5日,字节跳动宣布推出原生音视频全双工大模型 SeedRealtime。作为走向全模态交互的关键一步,SeedRealtime 用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来「边看、边听、边说」的全新体验。

技术亮点

与传统的轮流对话(turn-by-turn)不同,SeedRealtime 支持全双工交互——模型可以同时听和说,不需要等待用户说完才回复。这意味着 AI 助手可以在用户说话的过程中做出实时反应,比如点头、插话确认、或者中途打断。

此外,SeedRealtime 具备主动交互能力和抗干扰能力,意味着 AI 助手开始具备环境感知与社交智能。目前已在豆包 App 全量上线。

行业意义

SeedRealtime 的全量上线是豆包从「文本对话工具」向「全能 AI 伴侣」升级的关键一步。这将为更多场景创造全新交互范式,从语音助手到 AI 陪伴、从在线教育到远程协作。