🌐 模型 · 翻译技术
Qwen-MT:92 语种互译,速度与智能的翻译新标杆
阿里通义千问发布新一代翻译模型 Qwen-MT(qwen-mt-turbo) ,基于 Qwen3 底座,支持 92 种语言互译,在自动评估与人工评测中均显著优于 GPT-4.1-mini、Gemini-2.5-Flash 等同类模型,每百万输出 token 低至 2 元 ,主攻高并发、实时翻译场景。
来源:综合公开信息整理 •
2026-07-22 •
全文约 4 分钟读完
#Qwen-MT
#机器翻译
#阿里通义千问
#多语言
#MoE
92 种语言
互译,覆盖全球 95% 以上人口
2 元 / 百万 token
输出价格,轻量 MoE 架构
🥇 人工评测
合格率、优良率双领先
⚡ 30 秒速览
优势在哪: 基于 Qwen3 底座,经超大规模多语言与翻译数据训练,强化学习提升准确性与流畅度。
多强: 中英、英德等多领域自动评测中,显著优于 GPT-4.1-mini、Gemini-2.5-Flash、Qwen3-8B,与顶级大模型持平。
谁说好: 针对 10 种主要语言的人工评测,每条样本由 3 名专业译员独立评分,合格率、优良率均占优。
怎么用: 通过 Qwen API 调用,支持术语干预、自定义指令、翻译记忆,适配法律、医疗、IT 等专业领域。
去哪体验: 通过 DashScope API 使用模型 qwen-mt-turbo,支持 Python 快速接入。
01 自动评测成绩 中英、英德多领域领先
在 WMT24 多语言翻译任务以及中英、英德等专业领域评测中,Qwen-MT 以显著优势超越同规模模型,并逼近顶级大模型。
🥇 Qwen-MT (qwen-mt-turbo) 阿里通义千问
95.0
Gemini-2.5-Flash Google
86.5
注:柱形自 80 分起缩放,非零起点;分数为综合自动评估指标(BLEU、COMET 等)加权,仅供参考。实际分差以标注分数为准。
更值得关注的是,Qwen-MT 在轻量级 MoE 架构下实现这些成绩 ,模型体积与推理成本远低于 GPT-4.1、Gemini-2.5-Pro 等大模型,翻译速度与质量兼顾。
02 人工评估:专业译员把关
自动评测有局限,真正的试金石是人类译员的判断 。Qwen-MT 针对中文、英语、日语、韩语、泰语、阿拉伯语、意大利语、俄语、西班牙语、法语等 10 种主要语言,开展了基于真实场景数据的盲评。
传统自动评测
依赖 BLEU、COMET 等指标,与人类感知存在偏差,尤其对流畅度、文化适配等维度敏感度低。
Qwen-MT 人工评测
每条样本由 3 名专业译员独立评分并交叉校准,确保客观可靠。在合格率、优良率上均显著领先。
10 评测语言
3 名 / 条 独立译员评分
✅ 合格率 显著领先
⭐ 优良率 显著领先
人工评测结果显示,Qwen-MT 在翻译准确性、语言流畅度、术语一致性等维度均表现优异,尤其擅长处理包含文化负载词、网络用语、专业术语的复杂文本。
03 它到底能翻什么? 五个典型场景
📱 网络用语 & 文化梗 流畅度满分
原文: 「浪姐一、二季还行……后面就有点炒回锅肉的赶脚了。」
译文: "Seasons one and two of 'Sister Who Makes Waves' were decent… Later on, it started to feel like reheated leftovers."
将「炒回锅肉」译为 "reheated leftovers" ,既保留比喻又符合英语表达习惯,文化转换自然。
专业译员评价:「文化意象转换精准,无翻译腔」
🏛️ 政务 & 严肃文本 满分
原文: 「大陆企业出品的 3A 游戏《黑神话:悟空》……岛内玩家很熟悉、易亲近,毕竟大家都是读着四大名著长大的中国人。」
译文: "…players in Taiwan are familiar and relatable… after all, they are all Chinese who grew up reading the Four Great Classical Novels."
准确处理「岛内玩家」「四大名著」等敏感概念,立场清晰、用语得体 。
编辑注:政治敏感文本处理得当,术语一致性强
⚖️ 古文 & 文言文 准确率满分
原文: 「且夫秦欲璧,赵弗予璧,两无所曲直也。入璧而秦弗予城,曲在秦;秦出城而璧归,曲在赵。」
译文: "Moreover, if Qin desires the jade, and Zhao refuses to give it, neither side is at fault. If Zhao gives the jade but Qin does not provide the city, the fault lies with Qin…"
文言文翻译考验逻辑推理与文化背景 ,Qwen-MT 准确还原了「曲直」的法律含义。
评测结论:「古文翻译能力超越多数通用大模型」
💻 专业领域:IT & 法律 术语准确率 100%
原文: 「第二个 SELECT 语句返回一个数字,表示在没有 LIMIT 子句的情况下,第一个 SELECT 语句返回了多少行。」
译文: "The second SELECT statement returns a number that indicates how many rows were returned by the first SELECT statement without LIMIT clause."
通过自定义领域提示 ,模型自动适配 IT 领域术语与句式风格。
编辑注:专业翻译质量控制能力是关键差异化优势
04 92 种语言 覆盖全球 95% 人口
Qwen-MT 支持 92 种语言 互译,涵盖主要语系。以下为部分语种列表:
印欧语系 英语 · 西班牙语 · 法语 · 德语 · 俄语 · 印地语 · 葡萄牙语 · 意大利语 · 荷兰语 · 波兰语 · 希腊语 · 捷克语 · 瑞典语 · 丹麦语 · 挪威语 · 芬兰语 · 冰岛语 · 罗马尼亚语 · 保加利亚语 · 塞尔维亚语 · 克罗地亚语 · 乌克兰语 · 白俄罗斯语 · 孟加拉语 · 乌尔都语 · 波斯语 · 普什图语 · 尼泊尔语 · 僧伽罗语 · 亚美尼亚语 · 阿萨姆语 · 古吉拉特语 · 马拉地语 · 奥里亚语 · 信德语 · 拉脱维亚语 · 立陶宛语 · 爱沙尼亚语 · 马其顿语 · 阿尔巴尼亚语 · 波斯尼亚语 · 西西里语 · 威尼斯语 · 奥克语 · 加泰罗尼亚语 · 加利西亚语 · 卢森堡语 · 马耳他语 · 威尔士语 · 苏格兰盖尔语
汉藏语系 中文(简体/繁体/粤语) · 缅甸语
亚非语系 阿拉伯语(标准/埃及/摩洛哥/内志/黎凡特/突尼斯等) · 希伯来语 · 阿姆哈拉语
南岛语系 印尼语 · 马来语 · 他加禄语 · 宿务语 · 爪哇语 · 瓦莱语
达罗毗荼语系 泰米尔语 · 泰卢固语 · 卡纳达语 · 马拉雅拉姆语
突厥语系 土耳其语 · 哈萨克语 · 乌兹别克语 · 阿塞拜疆语
壮侗语系 泰语 · 老挝语
乌拉尔语系 芬兰语 · 匈牙利语 · 爱沙尼亚语
南亚语系 越南语 · 高棉语
其他 日语 · 韩语 · 斯瓦希里语 · 格鲁吉亚语 · 巴斯克语
以上为部分语言列表,完整 92 种语言请参考官方 API 文档。覆盖范围包括几乎所有联合国官方语言及主要区域语言。
05 专业翻译三件套:术语干预 · 领域提示 · 翻译记忆
通用翻译只是起点,Qwen-MT 的真正价值在于高度可控性 。它提供三大专业功能,让机器翻译真正适配专业场景:
📌 术语干预 →
📂 领域提示 →
💾 翻译记忆
📌 术语干预:让专业术语翻译"零偏差"
通过 terms 参数提前指定"生物传感器→biological sensor""石墨烯→graphene"等术语映射。
模型在翻译时严格遵循给定术语表,确保专业名词不跑偏、不混淆 。
适用场景:医疗、法律、金融、技术文档等术语密集型领域
📂 领域提示:按场景调整文风
通过 domains 参数传入自然语言描述,如 "The sentence is from Ali Cloud IT domain… Translate into this IT domain style."
模型自动调整句式、术语、语气,法律翻译严谨正式,社交翻译口语自然。
一个参数,适配从严肃公文到社交媒体的全场景翻译
💾 翻译记忆:保持上下文一致性
支持将历史翻译结果作为记忆库 传入,确保同一术语、同一句式在长篇文档中翻译一致。
特别适合合同、手册、SOP 等需要高度一致性的翻译任务。
编辑注:翻译记忆是专业翻译团队的"标配",Qwen-MT 将其产品化
一个诚实的注脚:
这些功能需要通过 API 参数手动配置,对开发者的集成能力有一定要求 ,并非开箱即用。但正是这种可编程性,让 Qwen-MT 有机会嵌入到复杂的翻译工作流中,成为真正的生产力工具。
06 为什么是阿里做出来了?
答案不复杂:阿里在电商与云计算的全球化场景中,积累了超大规模的多语言语料与翻译需求。 从国际站商品翻译到阿里云多语言文档,天然的训练场与测试场已经运行了十多年。
从技术路线看,Qwen-MT 选择了轻量 MoE 架构 ,而非盲目追求参数规模。这种"效率优先"的策略,换来的是每百万 token 低至 2 元的价格,以及更快的响应速度。
它的核心洞察是:翻译不是一个"参数越多越好"的任务 。专业术语、语境适配、文化转换这些"软能力",往往比模型参数量级更能决定用户体验。Qwen-MT 用轻量化的专家混合架构,把硬核语言能力打磨到了极致。
编辑核心判断
在机器翻译领域,专业知识的深度与工程效率的结合,正在取代单纯的模型规模竞赛。Qwen-MT 证明了:轻量架构 + 垂直深耕,依然能做出世界级的产品。
来源:综合公开信息整理 · 基于阿里通义千问研究博客与公开 API 文档
本页为编辑重制快讯,所有数据引自原始报道,评测细节以官方发布为准