KI-Übersetzung Qualität Benchmark
Wie gut InterMIND tatsächlich übersetzt – gemessen mit unserer automatisierten Testsuite anhand eines festen FLORES-200-Benchmark-Sets, pro Sprachpaar, jeden Monat. Synthetisch und reproduzierbar, keine herausgepickten Durchschnittswerte.
getippte Nachrichten, direkt im Text übersetzt
ein Wert für Spracherkennung und Übersetzung, Ende-zu-Ende
Score = semantische Treue zu einer Referenzübersetzung (0–100). Höher ist besser.
Text-Chat-Übersetzung
Getippte Nachrichten werden direkt beim Senden im Text übersetzt.
Durchschnittliche Qualität pro Sprache · Q4 2026gegenüber Q3 2026
Jeder Balken fasst alle Durchläufe zusammen, die in diesem Quartal in diese Sprache oder aus ihr übersetzen. Die gestrichelte Markierung zeigt das Vorquartal.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Sprachübersetzung
Live-Sprache, in Echtzeit transkribiert und übersetzt – das schwierigere Ende-zu-Ende-Problem.
Durchschnittliche Qualität pro Sprache · Q4 2026gegenüber Q3 2026
Jeder Balken fasst alle Durchläufe zusammen, die in diesem Quartal in diese Sprache oder aus ihr übersetzen. Die gestrichelte Markierung zeigt das Vorquartal.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Qualität im Zeitverlauf
Monatlicher Median pro Modalität, seit Beginn unserer Veröffentlichungen.
Diese Zahlen stammen aus echten Sitzungen
Jeder Durchlauf in der Live-Demo wird automatisch bewertet und fließt in den Benchmark des nächsten Monats ein. So sieht eine Sitzung aus:
Vollständige Datentabelle
Jedes veröffentlichte Paar und jeder Monat – Median, Spannweite und Stichprobengröße. Nach jeder Spalte sortierbar.