
2026年8月5日,字节跳动Seed团队正式推出音视频全双工大模型SeedRealtime,该模型以统一端到端架构原生融合音频、视频、文本三类模态,相较于传统级联方案可降低50%的对话节奏问题,目前相关能力已在豆包App全量上线,是国内首个实现规模化落地的音视频全双工交互大模型产品。

不少用户在使用AI音视频对话功能时都有过类似体验:刚说到一半AI就突然插话,或是说完要等几秒才能得到回应,频繁的节奏错位让交互体验远不如真人对话。SeedRealtime的上线,正是瞄准了这一困扰行业多年的痛点。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录