跳到主内容
@wquguru
精选88IT之家(RSS)模型发布/更新

阿里发布同声传译大模型Qwen3.8-LiveTranslate

阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出

原文
发到 X
推荐理由

同声传译是 AI 落地的高价值场景,Qwen3.8-LiveTranslate 在延迟和多模态处理上有实质突破,建议关注实时语音交互赛道的同学重点评估其性能指标。

IT之家 9 月 19 日消息,阿里千问今日发布同声传译大模型 Qwen3.8-LiveTranslate ,模型以 Interleave 架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。

官方表示,在支持 60 种语言的基础上,Qwen3.8-LiveTranslate 新增三项能力让同传更广泛的应用于真实场景中:

  • 实时说话人分离,每句话归属清晰,音色复刻更稳定;
  • 原文译文同帧同出,双语同屏;
  • 长上下文消歧,联系前文读懂当下,人名术语翻译更精准。

Qwen3.8-LiveTranslate 采用基于 Hybrid MoE 的 Thinker–Talker 双模块设计,通过 Interleave 方式衔接流式理解、文本输出与语音生成。其中,Thinker 把视频、音频、原文与译文编排进同一条因果序列,按时序交替排列、端到端产出,让理解与翻译在单一序列内完成;Talker 再结合译文和源音频,把译文合成为保留原说话人音色的译文语音。

在覆盖 14 个语向的多说话人长音频评测集 Omnilingua-MSpeaker 上,Qwen3.8-LiveTranslate 在翻译的忠实度、流畅度、简洁度以及说话人识别的错误率 DER(Diarization Error Rate,说话人分离错误率)四个维度上均优于目前行业主流实时同传系统。

官方在公开 FLEURS 音频测试集上评测了 70 个语言方向的实时同传表现。Qwen3.8-LiveTranslate 在翻译质量、字均延迟、语音识别准确率以及语音合成质量四个维度上领先于上一代以及当前主流实时同传系统。

IT之家附相关链接:

  • 尝鲜体验:https://omni.qwen.ai/live-translate
  • 模型 API:https://www.qianwenai.com/models/qwen3.8-livetranslate-flash-realtime

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

相似阅读

关联信息,但可能不是同一事件