阿里千问发布同声传译大模型Qwen3.8-LiveTranslate:原文译文同帧同出,字均延迟降至2.3秒
2026年9月19日,阿里千问正式推出同声传译大模型
Qwen3.8-LiveTranslate。该模型基于 Interleave 架构对实时同传流程进行了重构,在提升准确度、流畅度与简洁度的同时,将字均延迟(LAAL)从上一代的
2.8秒压缩至2.3秒。针对同传场景中“慢一秒就跟不上讲话人”的痛点,这0.5秒的降幅直接影响了听感的自然度。目前,该模型已通过
阿里云百炼(DashScope) 开放API,支持在线体验。
Interleave 架构与 Thinker–Talker 双模块
底层设计上,Qwen3.8-LiveTranslate 采用
Hybrid MoE 的
Thinker–Talker 双模块架构,配合音频与文本交织的单流式 Interleave 设计。这种结构让模型能够在处理语音输入的同时,以文本形式进行语义推理与翻译生成,从而在长对话场景中保持上下文连贯性。
值得注意的是,官方演示使用了《西游记》中的双人对话片段以及同音词示例,展示了模型在说话人归属、音色克隆与语义消歧方面的实际表现。
补齐同传落地的三块拼图
在已支持
60种语言 的基础上,Qwen3.8-LiveTranslate 新增了三大面向实用场景的能力:
-
实时说话人分离:每句话自动归到对应的发言人,音色复刻更稳定,避免“甲乙不分、声音串味”的混乱感。
-
原文译文同帧同出:双语文本在同一帧内同步输出,支持同屏显示,听众可以边听边对照校验。
-
长上下文消歧:模型会联系前文理解当下语境,在人名、术语等最容易出错的翻译节点上,精准度显著提升。
其中,60种语言支持中,有
29种语言可直接输出语音,进一步扩大了实时同传的适用边界。
评测数据与商用落地
在覆盖
14个语向 的 Omnilingua-MSpeaker 评测集上,Qwen3.8-LiveTranslate 在忠实度、流畅度、简洁度及说话人分离错误率(DER)四项指标上均优于主流同传系统。在 FLEURS 公开评测集的
70个语言方向 上,该模型同样领先于上一代及主流竞品。
官方同步公布了翻译质量对比数据:在 xCOMET-XXL 评分体系下,Qwen3.8-LiveTranslate 得分为
85.7,高于 GPT-Realtime-Translate 的
73.5 与 Gemini 3.5 Live Translate 的
65.2。
交付方式上,该模型采用
闭源商用 模式,未开放权重下载,仅通过阿里云百炼提供云端 API(模型编码:qwen3.8-livetranslate-flash-realtime)。分析认为,这一选择意味着阿里千问正将同传能力作为一项持续运营的云服务来打磨,而非一次性开源工具。
从实际落地角度看,实时说话人分离与长上下文消歧的组合,解决了会议、访谈、直播等多人对话场景中的核心痛点;而原文译文同帧同出的设计,则为需要“边听边对”的专业用户提供了更高效的校对路径。可以推断,随着API服务的开放,同声传译的实时性与可用性都将进入一个新的实用阶段。
参考资料
- 阿里千问发布实时同传大模型Qwen3.8-LiveTranslate- DoNews快讯 - DoNews
- 阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出|IT之家|Qwen 3|音频|错误率|和源_手机新浪网 - 新浪财经
- 【千问发布 Qwen3.8-LiveTranslate,同传延迟降至_凤凰网 - 凤凰网科技
- 驱动中国官方的微博 - 微博
- Qwen3.8-LiveTranslate发布:支持60种语言,字均延迟降至2.3秒 - 同花顺财经
- Qwen3.8-LiveTranslate: Names the Speaker. Carries the Meaning. - Alibaba Cloud Community - Alibaba Cloud
- Qwen3.8-LiveTranslate – 阿里通义推出的实时同声传译大模型 | AI工具箱 - AI工具箱
- #千问发布实时同传大模型#9 月 19 日消息,阿里千问推出同声传译大模型 Qwen3.8-LiveTranslate。模型依托 Interleave 架构重构实时同传,在准确度、流畅度、简洁度上实现全面升级,字均延迟(LAAL)由 2.8 秒缩短至 2.3 秒。该模型原本支持 60 种语言,此次新增三大实用能力:实时说话人分离,清晰区 _新浪新闻 - 手机新浪网
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。