探所 Curio 再探再报 了解探所 →
#AI

阿里发 Qwen3.8 同传模型,字均延迟 2.3 秒

阿里千问 9 月 19 日发布同传模型 Qwen3.8-LiveTranslate,字均延迟从 2.8 秒降到 2.3 秒,支持 60 种语言理解与 29 种语言语音输出。

模型走 Hybrid MoE 的 Thinker–Talker 双模块路线:Thinker 处理音频视频输入并翻译,Talker 生成保留原说话人音色的语音,两模块咬合流式理解、文本输出与语音生成。

评测两组:FLEURS 覆盖 70 个语言方向,自建 Omnilingua-MSpeaker 多说话人长音频集只覆盖 14 个语向。领先幅度官方未逐项给数字。

💡 为什么值得看阿里同传延迟降至 2.3 秒并支持多人分离,尚缺外部复现。

查证

来源档案

CocoLoop(转述阿里千问官方发布)

中文科技资讯站点,内容为阿里千问官方发布稿的转述与整理,文末列参考来源包括阿里千问官方发布、腾讯新闻、凤凰科技。

延迟、语种数与两组评测集的语向覆盖按官方口径核对,可作一手发布的二传使用;但四个维度的领先幅度无逐项数字,且尚无第三方独立复现,不宜当成已证实的性能结论。

延伸阅读

体验页实测 · news.cocoloop.cn 10 分钟
延迟数字只是官方口径,断句错误恢复速度、口音鲁棒度、专有名词一致性要在真实音频里跑过才知道,体验页已开。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中