Warum das Marketing für Übersetzungsqualität kaputt ist – und was wir stattdessen veröffentlichen
Öffnen Sie die Website eines beliebigen Anbieters für Live-Übersetzung. Sie werden immer dieselben Arten von Zahlen sehen:
- "200+ Sprachen"
- "6.000+ Sprachpaare"
- "Weltweit das erste" / "Höchste Genauigkeit"
- "99 % genau"
Versuchen Sie nun herauszufinden – auf einer dieser Anbieter-Seiten –, was diese Zahlen für ein Meeting bedeuten, das Sie gleich durchführen werden. Qualität pro Sprache. Reproduzierbare Methodik. Stichprobenumfang. Verlauf der Werte über die Zeit. Ehrliche Offenlegung der Schwächen des Modells.
Sie werden es nicht finden. Nicht im Marketing-Text und selten in den Docs.
Das ist das Gleichgewicht der Kategorie. Es existiert aus drei Gründen:
- Die meisten Anbieter besitzen keine eigene Übersetzungs-Engine. Sie leiten Anfragen über OpenAI, Google, DeepL, Microsoft oder eine Kombination daraus weiter. Die Veröffentlichung von Qualitätsdaten pro Sprachpaar wäre ein Benchmarking des Modells eines anderen – das hat keinen Marketing-Wert.
- Ehrliche Qualitätsdaten lassen sich schwer auf einem Billboard unterbringen. Ein einzelner Wert ist verrauscht. Eine Verteilung ist nützlicher, aber schwerer zu komprimieren. Ein
last-six-months trendist noch nützlicher und noch schwerer. - Der Einkauf hat bisher nicht widersprochen. Käufer akzeptieren die Marketing-Zahlen unkritisch, und so hält sich das Gleichgewicht.
Dieses Gleichgewicht wird nicht Bestand haben. Die nächste Käuferklasse – Pharma, Recht, Finanzen, Audit, öffentlicher Sektor – wird härtere Fragen stellen als „Wie viele Sprachen?". Wir haben /benchmark entwickelt, weil wir glauben, dass sie einem Anbieter nicht auf sein Wort hin vertrauen sollten.
Was Ihnen die Marketing-Zahlen nicht sagen
„200+ Sprachen" bedeutet, dass ein Anbieter ein Modell hat, das Text in 200 Sprachen ausgibt. Die Qualität über diese Sprachen hinweg reicht von produktionsreif für wichtige Paare (EN↔DE, EN↔ES, EN↔FR) bis kaum nutzbar für Paare mit geringen Ressourcen. Ohne eine Aufschlüsselung nach Sprachpaar können Sie nicht erkennen, auf welcher Seite dieser Linie Ihr Meeting landen wird.
„6.000+ Sprachpaare" ist N × N-Kombinatorik auf 80 Quellsprachen. Zu sagen, dass man 6.000 Paare unterstützt, ist der einfache Teil. Zu sagen, dass ein bestimmtes Paar gut genug für eine CAPA-Überprüfung, eine Vertragsverhandlung oder einen Earnings Call ist – das ist der Teil, der nicht in der Broschüre steht.
„99 % genau", ohne anzugeben, was gemessen wurde, gegen welche Referenz, an welcher Stichprobe, von welchem Prüfer – ist inhaltsleer. Übersetzungsqualität hat keinen universellen Skalarwert. Sie hat eine Verteilung, die vom Sprachpaar, Inhaltsbereich, der Audioqualität (für Sprache), dem Latenzbudget und davon abhängt, was „gut genug" für den spezifischen Anwendungsfall bedeutet.