DataLearner 标志
QW

Qwen3.8-LiveTranslate

翻译大模型Qwen Audio / RealtimeQwen3.8

Qwen3.8-LiveTranslate-Flash-Realtime

别名:Qwen3.8 LiveTranslate

发布时间: 2026-09-18更新于: 2026-09-28浏览量: 267
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
53K
多语言支持
60 input / 29 speech output 种语言
推理能力
暂无数据

Qwen3.8-LiveTranslate 是阿里通义千问的实时同传 API,支持 60 种源语言和 29 种语音输出,官方评测的长度自适应平均延迟(LAAL)为 2.3 秒。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Qwen3.8-LiveTranslate

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
53K tokens
最大输出长度
4K tokens
模型类型
翻译大模型
输入/输出模态
图像、音频 → 文本、音频
发布时间
2026-09-18
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
暂无数据
Qwen3.8-LiveTranslate

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
Qwen3.8-LiveTranslate

官方介绍与博客

DataLearnerAI博客
暂无
Qwen3.8-LiveTranslate

API接口信息

接口速度
暂无数据
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-—$20.00/ 1M tokens
图像-$0.550/ 1M tokens—
音频-$7.50/ 1M tokens$30.00/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Qwen3.8-LiveTranslate

发布机构

Qwen3.8-LiveTranslate-Flash-Realtime

模型解读

Qwen3.8-LiveTranslate 是阿里通义千问在 2026 年 9 月 18 日官方博客中发布的实时同传模型,API 型号为 qwen3.8-livetranslate-flash-realtime。模型把输入语音实时翻译为文字和语音,并可利用画面提供的上下文;官方给出的 2.3 秒是评测指标,不是 API 响应时间承诺。

能理解的语言多于能生成语音的语言

官方完整语种表列出 60 种语音输入与文本输出语言,以及 29 种语音输出语言。能识别或显示某种语言,不代表能用该语言发声。官方还介绍了说话人分离与音色保留、原文译文同步显示,以及借助上下文消除人名和术语歧义。

29 种语音输出语言

Chinese, English, German, Italian, Portuguese, Spanish, Japanese, Korean, French, Russian, Thai, Indonesian, Arabic, Vietnamese, Turkish, Finnish, Polish, Hindi, Dutch, Czech, Urdu, Filipino, Swedish, Danish, Hebrew, Icelandic, Malay, Norwegian, Persian。

另外 31 种语音输入与文本输出语言

Afrikaans, Asturian, Azerbaijani, Belarusian, Bengali, Bosnian, Bulgarian, Cantonese, Catalan, Cebuano, Croatian, Estonian, Galician, Gujarati, Greek, Hungarian, Javanese, Kannada, Kazakh, Kyrgyz, Latvian, Macedonian, Malayalam, Marathi, Punjabi, Romanian, Slovak, Slovenian, Swahili, Tajik, Ukrainian。这 31 种语言不在官方语音输出清单中。

延迟与翻译质量仍应按官方评测口径理解

官方称 Interleave 架构把长度自适应平均延迟(LAAL)从 2.8 秒降至 2.3 秒。该指标衡量评测协议下的翻译滞后,并不构成线上服务的延迟保证。发布博客还给出 Omnilingua-MSpeaker 与 FLEURS 上的翻译质量对比;这些属于厂商自测,本次复核未找到这一具体版本的独立测试。

输入与输出费用需要一起计算

模型以闭源 API 方式通过 QwenCloud 和阿里云百炼提供。QwenCloud 每百万 tokens 的价格为:音频输入 7.5 美元、图像输入 0.55 美元、文本输出 20 美元、音频输出 30 美元。输入和生成输出分别计费,单独的音频输入价格不能代表语音同传的总成本。

实时译声与字幕是适用场景

会议同传和直播字幕需要本模型的翻译及流式输出能力。只需原文转写时,应比较专用 ASR 模型;把给定文字读出来则属于 Qwen-Audio-3.1-TTS-Flash 的任务。面向语音本地化时,应先确认目标语言在 29 种语音输出范围内。

来源:Qwen 官方发布与语种表;QwenCloud 模型及价格。复核日期:2026 年 9 月 28 日。

Qwen3.8-LiveTranslate

常见问题

Qwen3.8-LiveTranslate 的 API 型号是什么?

API 型号为 qwen3.8-livetranslate-flash-realtime,通过 QwenCloud 与阿里云百炼提供。

支持多少种语言?

官方表格列出 60 种语音输入与文本输出语言、29 种语音输出语言,不能把两种范围混为一谈。

2.3 秒是 API 延迟保证吗?

不是。2.3 秒为官方评测的长度自适应平均延迟(LAAL),上一代为 2.8 秒,不代表线上服务响应时间保证。

国际站怎么收费?

QwenCloud 每百万 tokens:音频输入 7.5 美元、图像输入 0.55 美元、文本输出 20 美元、音频输出 30 美元。输入与生成输出分别计费。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码