97AI.PRO
2026-08-05 · AI 资讯

字节SeedRealtime发布,豆包全量上线实时全双工交互体验

字节SeedRealtime发布,豆包全量上线实时全双工交互体验
字节SeedRealtime发布,豆包全量上线实时全双工交互体验

字节跳动Seed团队正式发布SeedRealtime模型,通过统一的端到端架构,实现了音频、视频与文本的原生融合。该技术已在豆包App全量上线,率先推动了全双工语音交互的大规模落地,让用户能够体验到“边看、边听、边说”的自然流畅对话。

与传统采用“听—转写—想—说”拼接路径的级联方案不同,SeedRealtime将音视频的感知与表达整合在同一个模型内部。这种全模态架构显著改善了人机交互的节奏感,减少了抢话、停顿突兀或逻辑断层等问题,使AI在对话时具备了类似于真人的“分寸感”与呼吸间隙。

这一创新标志着全模态智能助手技术路线的演进,即不再依赖多个单模态模型的级联管道,而是由一个具备全感知的模型完成实时处理,进一步缩小了人机交互的鸿沟,让AI更像是一个实时陪伴的交互伙伴。