Proč je marketing kvality překladu chybný — a co zveřejňujeme my místo něj

Každý poskytovatel překladů zveřejňuje počty jazyků. Žádný nezveřejňuje vérifikovatelnou kvalitu pro jednotlivé jazykové páry na reálném provozu. Proč na této mezeře záleží při vašem příštím výběrovém řízení — a co zveřejňujeme my místo toho.

The Mind.com Team

Proč je marketing kvality překladu chybný — a co zveřejňujeme my místo něj

Proč je marketing kvality překladu rozbitý — a co publikujeme my místo něj

Otevřete web libovolného poskytovatele živého překladu. Uvidíte pořád stejné druhy čísel:

  • „200+ jazyků“
  • „6 000+ jazykových párů“
  • „První na světě“ / „Nejvyšší přesnost“
  • „99% přesnost“

Zkuste teď na kterékoli z těch stránek najít, co tato čísla znamenají pro schůzku, kterou se chystáte vést. Kvalitu po jednotlivých jazycích. Reprodukovatelnou metodiku. Velikost vzorku. Vývoj skóre v čase. Upřímné přiznání, kde je model slabý.

Nenajdete to. Ani v marketingových textech, a jen zřídka v dokumentaci.

Je to rovnováha celé kategorie. Existuje ze tří důvodů:

  1. Většina poskytovatelů nevlastní vlastní překladový engine. Směrují provoz přes OpenAI, Google, DeepL, Microsoft nebo jejich kombinaci. Publikovat kvalitu po jednotlivých párech by znamenalo srovnávat model někoho jiného — a to nemá žádnou marketingovou hodnotu.
  2. Upřímná data o kvalitě se špatně dávají na billboard. Jediné skóre je zašuměné. Rozdělení je užitečnější, ale hůř se stlačuje. Užitečnější je ještě last-six-months trend, a zkomprimovat ho je ještě těžší.
  3. Nákup zatím nezačal klást odpor. Kupující přijímají marketingová čísla tak, jak jsou, a rovnováha tak drží.

Rovnováha držet nebude. Další třída kupujících — farmacie, právo, finance, audit, veřejný sektor — bude klást těžší otázky než „kolik jazyků“. Vytvořili jsme /benchmark, protože si myslíme, že by nemuseli brát slovo poskytovatele bez ověření.


Co vám marketingová čísla neříkají

„200+ jazyků“ znamená, že poskytovatel má model, který generuje text ve 200 jazycích. Kvalita napříč těmito jazyky sahá od produkční úrovně u hlavních párů (EN↔DE, EN↔ES, EN↔FR) až po sotva použitelnou u párů s málo zdroji. Bez rozpisu po jednotlivých párech nepoznáte, na které straně té hranice vaše schůzka skončí.

„6 000+ jazykových párů“ je kombinatorika N × N nad 80 zdrojovými jazyky. Prohlásit, že podporujete 6 000 párů, je ta snadná část. Prohlásit, že konkrétní pár stačí na CAPA review, vyjednávání smlouvy nebo výsledkový hovor — to je část, která v brožuře chybí.

„99% přesnost“ je bez udání toho, co se měřilo, proti jaké referenci, na jakém vzorku a kdo hodnotil, bez obsahu. Kvalita překladu nemá univerzální skalární hodnotu. Má rozdělení, které závisí na jazykovém páru, oblasti obsahu, kvalitě zvuku (u hlasu), latenčním rozpočtu a na tom, co znamená „dost dobré“ pro konkrétní případ užití.


Co kupující skutečně potřebuje vědět

Otázky, které zazní v reálných DPA review a při vyhodnocování nabídek:

  1. Kvalita po jednotlivých párech — jak si vede konkrétně na DE↔EN, EN↔AR, JA↔KO?
  2. Velikost vzorku — na kolika během je vaše uvedené číslo založeno? Na deseti? Na deseti tisících?
  3. Metodika — kdo překlady hodnotí, proti jaké referenci a podle jakého hodnoticího schématu?
  4. Rozdělení, ne průměr — jak vypadá nejhorších 10 %? Nejlepších 10 %? Medián?
  5. Vývoj v čase — zlepšil se nebo zhoršil daný pár od doby, kdy jste naposledy zveřejnili číslo?
  6. Co neměříte — co váš benchmark výslovně nezachycuje?

Žádná z těchto otázek není nezodpověditelná. Jen nejsou na ničí marketingové stránce.


Co publikujeme my

/benchmark je naše odpověď. Metodika je na /benchmark/methodology — napsaná dřív, než jsme tušili, že tohle budete číst.

Od běžných zvyklostí kategorie ho odlišují tři věci.

1. Skutečný provoz, ne vybraná sada

Každé skóre ve veřejném benchmarku pochází ze skutečného testovacího běhu v /demo. Nevybíráme předem páry, které si vedou dobře. Stejná pipeline, která obsluhuje demo pro kupujícího, je ta, která se měří.

2. Hodnotitel je pojmenován

Primární: google/gemini-3.5-flash. Záložní: anthropic/claude-sonnet-5. Oba přes Vercel AI Gateway. Hodnotitel je součástí metodiky — uvádíme ho jménem. Když hodnotitele změníme (už se to stalo, protože modely se vyřazují), historické záznamy nesou hodnotitele, který je skutečně ohodnotil; stará skóre se nikdy tiše nepřepočítávají.

3. Daty je rozdělení, ne průměr

Každý publikovaný řádek ukazuje medián, p10, p90, minimum, maximum a velikost vzorku — ne jediné číslo. Jediné číslo pro překladový pár je šum. Tvar rozdělení je signál.


Postupy, které kategorie nepřijala

  • Páry s nízkým skóre neskrýváme. Veřejný index je podmíněn ≥ 10 distinct IPs, ≥ 10 runs, median ≥ 60 — ale kdokoli může odkázat přímo na libovolný pár a vidět skutečná čísla, včetně párů, kterým se tento měsíc nedaří.
  • Známé problémy dokumentujeme. Když byl testovací nástroj chatu několik týdnů na počátku roku 2026 rozbitý, je toto období z indexu vyloučeno a písemně zaznamenáno na stránce s metodikou. Historie se tiše nepřepisuje.
  • Co výslovně NETVRDÍME je samostatná sekce na stránce s metodikou. Uvádíme, kde je sám LLM hodnotitel nedokonalý. Uvádíme, co neměříme (latenci, náklady, spokojenost uživatelů, chyby na straně ASR ještě před spuštěním překladu). A přiznáváme, že součástí provozu jsou i naše vlastní automatické smoke testy.

Filtr pro příští vyhodnocení poskytovatele

Pokud vyhodnocujete jakoukoli platformu pro vícejazyčné schůzky — naši nebo jinou — stojí za přečtení právě metodika. Samotná čísla jsou ta snadná část.

Praktický filtr pro jakéhokoli poskytovatele v této kategorii:

  • Požadujte kvalitu po jednotlivých jazykových párech a po měsících, měřenou na skutečném provozu. Ne vybraný benchmark. Ne souhrnnou hodnotu.
  • Zeptejte se, kdo je jejich hodnotitel, co výslovně neměří a co se změnilo za posledních šest měsíců.
  • Zeptejte se, co se stane, když skóre páru klesne — řeknou to někomu, nebo to potichu opraví?

Pokud má poskytovatel všechny tři odpovědi písemně, vyhodnoťte ho vážně. Pokud ne, kupujete marketing — ne kvalitu překladu.


Vyzkoušejte si to sami

  • Vyzkoušejte živé demo — spustí produkční překladovou pipeline na vašem zvuku, ohodnotí výsledek stejným hodnotitelem, který bodově hodnotí veřejný benchmark, a ukáže vám výstup.
  • Prohlédněte si benchmark — každý publikovaný jazykový pár, každý měsíc, s úplným rozdělením.
  • Přečtěte si metodiku — jak se čísla počítají, co zahrnují a co ne.

Nemusíte nám v ničem věřit na slovo. O to jde.


Zdroje: identifikátory hodnotitelů, prahové hodnoty pro zařazení do indexu a pravidla vyloučení uvedené výše jsou ověřeny proti nasazenému kódu a zveřejněny na /benchmark/methodology; hodnotitelé jsou poskytováni přes Vercel AI Gateway; marketingová tvrzení citovaná na začátku jsou typické formulace v kategorii, nikoli citace konkrétního poskytovatele; ověřeno v srpnu 2026.

Další v tématu Živý překlad

Všechny články v tématu Živý překlad
Turecký hlasový překladač: sloveso přichází až nakonec a právě to rozhoduje, který potřebujete
Živý překlad

Turecký hlasový překladač: sloveso přichází až nakonec a právě to rozhoduje, který potřebujete

V turečtině stojí sloveso – a také zápor a čas – na konci věty. Právě tento jediný fakt odděluje tři produkty prodávané jako „hlasový překladač“: aplikace pro telefon, překladatelská sluchátka a živý překlad meetingů. Co všechno dokáže každý z nich s tureckou větou a co ne, a proč vám počet jazyků, který uvádí dodavatel, o tomto jazykovém páru nic neříká.

The Mind.com Team

Simultánní tlumočník: člověk, platforma RSI, nebo AI – co váš vícejazyčný meeting skutečně potřebuje (2026)
Živý překlad

Simultánní tlumočník: člověk, platforma RSI, nebo AI – co váš vícejazyčný meeting skutečně potřebuje (2026)

„Simultánní tlumočník“ je profese; většina lidí však ve skutečnosti hledá řeč, která dorazí v jiném jazyce přesně ve chvíli, kdy se mluví. Tento průvodce odděluje tlumočnickou kabinu, platformu RSI a AI simultánní překlad, porovnává nástroje podle jejich dokumentace – Interprefy, KUDO, Wordly, DeepL Voice, Zoom, Teams, Google Meet, InterMIND – a ptá se na to, co srovnání přehlížejí: kolik z meetingu se vám skutečně vrátí ve vašem jazyce a kde se zpracovávají data.

The Mind.com Team

Simultánní překlad: kabina, RSI, nebo AI — a které nástroje pro vaše meetingy (2026)
Živý překlad

Simultánní překlad: kabina, RSI, nebo AI — a které nástroje pro vaše meetingy (2026)

„Simultánní překlad“ zahrnuje tři různé reality: tlumočníka v kabině, vzdálené simultánní tlumočení (RSI) a AI překlad v reálném čase. Tento průvodce tyto tři přístupy odlišuje, porovnává zdokumentované nástroje — Interprefy, KUDO, Wordly, DeepL Voice, Zoom, Teams, Google Meet, InterMIND — a klade otázku, kterou srovnávací články přeskakují: kolik z meetingu se vám skutečně vrátí ve vašem jazyce?

The Mind.com Team

Odebírejte nové články a novinky o produktu e-mailem

Jeden e-mail měsíčně s novými články a novinkami o produktu. Odhlásit se můžete kdykoli.