Чому маркетинг якості перекладу зламаний — і що ми публікуємо натомість
Відкрийте сайт будь-якого постачальника послуг живого перекладу. Ви побачите однакові показники:
- «200+ мов»
- «6000+ мовних пар»
- «Перший у світі» / «Найвища точність»
- «99% точності»
Тепер спробуйте знайти — на будь-якій з цих сторінок постачальників — що ці цифри означають для зустрічі, яку ви збираєтесь провести. Якість для кожної мови. Відтворювана методологія. Розмір вибірки. Динаміка оцінки в часі. Чесне визнання того, де модель слабка.
Ви цього не знайдете. Ні в маркетингових матеріалах, і рідко в документації.
Це рівновага категорії. Вона існує з трьох причин:
- Більшість постачальників не володіють власним рушієм перекладу. Вони маршрутизують запити через OpenAI, Google, DeepL, Microsoft або їхню комбінацію. Публікація даних про якість для кожної пари означала б бенчмаркінг чужої моделі — в цьому немає маркетингової цінності.
- Чесні дані про якість важко розмістити на білборді. Єдина оцінка містить багато шуму. Розподіл є кориснішим, але його важче стиснути.
last-six-months trendє ще кориснішим і ще складнішим для стиснення. - Відділ закупівель ще не дав відсічі. Покупці приймають маркетингові цифри за чисту монету, і тому рівновага зберігається.
Ця рівновага не втримається. Наступний клас покупців — фармацевтика, юридичний сектор, фінанси, аудит, державний сектор — ставитиме складніші запитання, ніж «скільки мов». Ми створили /benchmark, тому що вважаємо, що їм не доведеться брати слово постачальника на віру.
Чого не кажуть маркетингові цифри
«200+ мов» означає, що у постачальника є модель, яка видає текст 200 мовами. Якість для цих мов коливається від придатної для виробничого використання для основних пар (EN↔DE, EN↔ES, EN↔FR) до ледь придатної для малоресурсних пар. Без розбивки по кожній парі ви не можете сказати, на який бік від цієї межі потрапить ваша зустріч.
«6000+ мовних пар» — це N × N комбінаторика для 80 вихідних мов. Сказати, що ви підтримуєте 6000 пар, — це легка частина. Сказати, що будь-яка конкретна пара достатньо хороша для перевірки CAPA, переговорів щодо контракту або звітного дзвінка про прибутки — це та частина, якої немає в рекламному проспекті.
«99% точності», без уточнення, що було виміряно, з яким еталоном, на якій вибірці, яким суддею — не несе жодного змісту. Якість перекладу не має універсального скаляра. Вона має розподіл, який залежить від мовної пари, предметної області, якості аудіо (для голосу), бюджету затримки та того, що означає «достатньо добре» для конкретного випадку використання.