时间:2026年9月19日
地点:中国北京(阿里千问团队)
人物:阿里千问团队
事件详情:阿里千问于2026年9月19日正式发布同声传译大模型 Qwen3.8-LiveTranslate。该模型采用基于 Hybrid MoE 的 Thinker–Talker 双模块设计,通过 Interleave 方式衔接流式理解、文本输出与语音生成,将字均延迟(LAAL)从上一代的 2.8 秒压缩至 2.3 秒。新模型继续支持 60 种语言互译,并新增三项面向真实场景的能力:实时说话人分离(每句话归属清晰,音色复刻更稳定)、原文译文同帧同出(双语同屏)、长上下文消歧(联系前文读懂当下,人名术语翻译更精准)。在覆盖 14 个语向的多说话人长音频评测集 Omnilingua-MSpeaker 上,Qwen3.8-LiveTranslate 在翻译忠实度、流畅度、简洁度与说话人识别错误率 DER 四个维度均优于目前行业主流实时同传系统;在公开 FLEURS 音频测试集上覆盖 70 个语言方向的实时同传表现亦全面领先。
背景:这是阿里千问同传产品线的最新迭代。前代 Qwen3.5-LiveTranslate 于 2026 年 5 月 20 日发布,已覆盖 60 种语言;Qwen3-LiveTranslate 更早在 2025 年 9 月支持 18 种语言+5 种中文方言。行业另一款强对照产品为字节豆包 Seed LiveInterpret 2.0,于 Qwen-MT 发布同日上线。国际市场上,OpenAI、Google 等也持续投入实时多模态翻译,国产大模型在"延迟+多语种+音色复刻"维度已具备正面竞争能力。
影响:字均延迟从 2.8 秒压到 2.3 秒,降幅约 18%,但准确度不降反升——专业术语识别准确率提升至 98.7%(官方引用测试数据)。这意味着实时翻译进入"接近人类同传反应速度"区间,对国际会议、跨境直播、医疗学术论坛、远程司法听证等高实时刚需场景是实质性升级。模型已在阿里云百炼平台开放 API 公测,高校与中小企业可享首月免费额度;同步上线 LiveTranslate Studio 轻量桌面端,支持本地化部署+离线语音缓存。
总结:阿里千问 Qwen3.8-LiveTranslate 用 Interleave 架构突破长期困扰 AI 同传的"2.8 秒魔咒",把延迟压至 2.3 秒且翻译质量保持领先。这是国产大模型从"能说"迈向"敢说、说得准"的关键一步,也为即将到来的全球 AI 实时通信基础设施竞争打下基础。
参考来源:
- IT之家:https://www.ithome.com/1/004/450.htm
- 新浪财经:https://finance.sina.com.cn/tech/digi/2026-09-19/doc-inisiwwa9879563.shtml
- 搜狐:https://m.sohu.com/a/1078215044_313745
- 网易新闻:https://www.163.com/dy/article/L76SU3G90511A6N9.html
- 阿里云官方文档:https://help.aliyun.com/zh/model-studio/qwen3-5-livetranslate-flash-realtime
- 通义千问官方体验:https://omni.qwen.ai/live-translate
- 模型 API:https://www.qianwenai.com/models/qwen3.8-livetranslate-flash-realtime







