阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate - Sohu
Кратко: 阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate
IT之家 9 月 19 日消息,阿里千问今日发布同声传译大模型 Qwen3.8-LiveTranslate ,模型以 Interleave 架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。
官方表示,在支持 60 种语言的基础上,Qwen3.8-LiveTranslate 新增三项能力让同传更广泛的应用于真实场景中:
- 实时说话人分离,每句话归属清晰,音色复刻更稳定;
- 原文译文同帧同出,双语同屏;
- 长上下文消歧,联系前文读懂当下,人名术语翻译更精准。
Qwen3.8-LiveTranslate 采用基于 Hybrid MoE 的 Thinker–Talker 双模块设计,通过 Interleave 方式衔接流式理解、文本输出与语音生成。其中,Thinker 把视频、音频、原文与译文编排进同一条因果序列,按时序交替排列、端到端产出,让理解与翻译在单一序列内完成;Talker 再结合译文和源音频,把译文合成为保留原说话人音色的译文语音。
🧭 Извлечение: ok
· confidence 90%
· диагностика
High confidence: full text extraction produced 490 characters.
High confidence: full text extraction produced 490 characters.
阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate
IT之家 9 月 19 日消息,阿里千问今日发布同声传译大模型 Qwen3.8-LiveTranslate ,模型以 Interleave 架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。
官方表示,在支持 60 种语言的基础上,Qwen3.8-LiveTranslate 新增三项能力让同传更广泛的应用于真实场景中:
- 实时说话人分离,每句话归属清晰,音色复刻更稳定;
- 原文译文同帧同出,双语同屏;
- 长上下文消歧,联系前文读懂当下,人名术语翻译更精准。
Qwen3.8-LiveTranslate 采用基于 Hybrid MoE 的 Thinker–Talker 双模块设计,通过 Interleave 方式衔接流式理解、文本输出与语音生成。其中,Thinker 把视频、音频、原文与译文编排进同一条因果序列,按时序交替排列、端到端产出,让理解与翻译在单一序列内完成;Talker 再结合译文和源音频,把译文合成为保留原说话人音色的译文语音。