
2026年8月6日,字节跳动旗下Seed团队正式推出原生音视频全双工大模型SeedRealtime,该产品采用统一架构融合音视频与文本模态,可实现“边看、边听、边说”的低延迟实时交互。同期DeepSeek、MiniMax、月之暗面等多家国产大模型厂商密集迭代,行业分析认为相关技术突破将持续强化国产算力全产业链景气度。

和此前行业普遍采用的多模块拼接方案不同,SeedRealtime采用原生统一架构整合音频、视频、文本三大模态的处理能力,无需在不同模块之间做接口适配和数据转换,端到端交互延迟较行业平均水平降低近40%。
用户在与搭载该模型的产品交互时,无需等待AI完成整段回复即可随时打断,还能同步提供语音指令、画面素材等多维度信息,交互流畅度已经接近真人面对面沟通的体验。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录