阿里发布 Qwen3.8-LiveTranslate 实时语音翻译模型
阿里发布 Qwen3.8-LiveTranslate实时语音翻译模型: 一边听、一边译、一边说 这次升级集中在四项能力: 分清谁在说话:流式区分多位说话人,并让译文语音尽量保留各自音色; 原文译...
阿里新出的 Qwen3.8-LiveTranslate 能一边听一边实时翻译,比之前快了半秒,适合多人会议用。
阿里发布的 Qwen3.8-LiveTranslate 模型能流式区分多位说话人并保留音色,在 FLEURS 测试中,译文平均落后原话的时间从 2.8 秒降至 2.3 秒。
阿里发布 Qwen3.8-LiveTranslate实时语音翻译模型: 一边听、一边译、一边说 这次升级集中在四项能力: 分清谁在说话:流式区分多位说话人,并让译文语音尽量保留各自音色; 原文译...
阿里发布 Qwen3.8-LiveTranslate实时语音翻译模型: 一边听、一边译、一边说 这次升级集中在四项能力: 分清谁在说话:流式区分多位说话人,并让译文语音尽量保留各自音色; 原文译文同步出现:同一条数据流同时返回源语言识别结果与目标语言译文,便于字幕核对与内容整理; 用前文和画面消歧:结合长上下文与静态图像帧,处理指代、专名和同音词; 减少流式等待:把音频和文字交替放进同一条处理流,复用已经听过的音频和已经生成的译文;在 FLEURS 测试中,译文平均落后原话的时间从上一代的 2.8 秒降到 2.3 秒。 种支持与覆盖范围 系统对不同语种提供三种能力: 音频输入 · 60 种:可以把这些语言作为源语音送入模型; 文字输出 · 60 种:可以返回这些目标语言的翻译文本; 语音输出 · 29 种:只有这个子集可以进一步合成目标语言语音。 Your browser does not support the video tag. 🔗 View on Twitter 💬 12 🔄 7 ❤️ 35 👀 4690 📊 19 ⚡