Qwen3.8-LiveTranslate同步口译延迟降到2.3 秒
2026-09-20分类:人工智能 阅读()

阿里巴巴9 月19 日发布新一代即时同步口译模型Qwen3.8-LiveTranslate。依Qwen 团队在官方帐号公布的说明,这个版本采用Interleave 架构,在60 种语言上把平均延迟从2.8 秒降到2.3 秒,同时在忠实度、流畅度与简洁度上都有改善。
延迟从2.8 秒降到2.3 秒
同步口译要处理的核心矛盾是等待与准确之间的取舍。模型听得越久,掌握的语意越完整,译得越准,但使用者也等得越久。官方采用的衡量指标是平均延迟(LAAL),也就是译文相对于原文平均落后多少时间。
这一版把这个数字从2.8 秒压到2.3 秒,差距约半秒。在口译情境中,半秒是对话节奏会不会断掉的差别。
三项新能力都指向多人对话
官方列出的三项新功能,方向一致。第一是即时区分说话人,能在多人同时发言的场合分辨谁在讲话,并透过更稳定的声音复制,让每位说话者的译文保留各自音色。
第二是原文与译文同步显示,两种语言同时出现在画面上。第三是长脉络消歧,模型会利用先前的对话内容来判断人名与专业术语,让同一个词在整场对话中翻译一致。
这三项要解决的都是单向逐句翻译处理不了的状况:会议有多个人讲话、听众需要对照原文、同一个专有名词在一场对话里反复出现。
走云端服务,没有开源权重
Qwen3.8-LiveTranslate 透过QwenCloud 提供,官方公告中给的是部落格与云端服务连结。链新闻查询Hugging Face,未见这个模型的权重上架,与Qwen 系列部分版本开源的做法不同。
同属Qwen 3.8 系列的文字模型则可在本地执行,Vitalik 先前实测在笔电上的推论速度约每秒33 个token。
Tags:
