公开透明的翻译质量

AI 翻译 质量 基准

InterMIND 的实际翻译水平——由我们的自动化测试套件基于固定的 FLORES-200 基准集,按语言对每月测得。数据为合成且可复现,而非精挑细选的平均值。

聊天翻译
91/100
中位数 · 22 个语言对 · 22 次运行 · Q4 2026

输入的消息,内联翻译

语音翻译
93/100
较 Q3 2026:+3中位数 · 22 个语言对 · 22 次运行 · Q4 2026

语音识别与翻译的端到端综合得分

44 语言对·45 已评分测试次数·23 种语言·每月更新 · 2026年10月

得分 = 与参考译文的语义忠实度(0–100)。分数越高越好。

优秀 90+ 良好 70–89 一般 50–69 较弱 <50

文本聊天翻译

输入的消息在发送时即时内联翻译。

本季度 23 种语言中有 23 种平均水平达到良好及以上(70 分以上) · 较 Q3 2026 提升 14 项

各语言平均质量 · Q4 2026较 Q3 2026

每根柱条汇总了本季度所有翻译至该语言或从该语言翻译的测试。虚线刻度标示上一季度的水平。

Q4 2026 (avg) Q3 2026 中位数 91 · Q4 2026
100
75
50
25
0
100
100
100
97
96
94
94
92
92
91
91
91
91
91
89
89
88
88
88
88
87
87
71
▲2es
▲4it
▲1pt
▲1ro
▲3fr
▲7ko
▲3pl
▼1sv
▲5zh
▲6fi
▼4de
▲2en
▼4ja
▲30tr
▲9is
▼2nl
▼4da
▲3ru
▼1uk
▼3no
▼4cs
▲26hi
▼13hu

Faded bars have a thin sample (<3 runs) — read them as provisional.

语音翻译

实时语音转写并翻译——难度更高的端到端问题。

本季度 23 种语言中有 23 种平均水平达到良好及以上(70 分以上) · 较 Q3 2026 提升 19 项

各语言平均质量 · Q4 2026较 Q3 2026

每根柱条汇总了本季度所有翻译至该语言或从该语言翻译的测试。虚线刻度标示上一季度的水平。

Q4 2026 (avg) Q3 2026 中位数 93 · Q4 2026
100
75
50
25
0
100
98
97
97
97
96
96
96
95
94
93
92
92
91
90
89
89
89
88
87
85
83
76
▲8ko
▲3es
▲2zh
▲3ja
▲1it
▲4uk
▲3pt
▲3ro
▲10ru
▲3pl
▲1fr
•nl
▲4en
▲1cs
▲1no
▲2sv
▲9hu
▲4de
•da
▼4hi
•fi
▲5is
▲8tr

Faded bars have a thin sample (<3 runs) — read them as provisional.

质量变化趋势

自开始发布以来,各模态的月度中位数。

聊天 语音
100
75
50
25
0
98
68
99
77
92
94
84
92
91
93
2026年3月
2026年4月
2026年5月
2026年7月
2026年8月
2026年9月
2026年10月

这些数据来自真实会话

在线演示中的每次测试都会自动评分,并计入下月的基准。一次会话如下所示:

实时翻译会议
→ EN

完整数据表

每个已发布的语言对和月份——中位数、范围和样本量。可按任意列排序。

常见问题