Говоріть власним голосом — мовою, якою ви не володієте
Ось та частина перекладу у реальному часі, яку майже всі трактують помилково і про яку майже ніхто не говорить: голос, який ви чуєте.
Ви можете мати чудове розпізнавання мовлення та чудовий переклад, але в результаті отримати мітинг, що нагадує читання списку машиною. Бо на останньому кроці — перетворенні перекладеного тексту назад на звук — більшість інструментів непомітно замінюють вас на один узагальнений синтетичний голос. Вісім людей у кімнаті, один голос робота для всіх. Ви втрачаєте те, хто говорить, інтонації, індивідуальність. Зрозуміло, але це не розмова.
InterMIND виконує останній крок інакше. Коли ви говорите, інші учасники чують переклад голосом, який впізнається як ваш — із вашим тембром та вашою манерою мовлення — тепер промовляючи слова їхньою мовою. Це ще не бездоганна імітація, але суть у тому, що це ви, а не шаблонний диктор, і це стає кращим. Це працює для кожного учасника, в обох напрямках, одночасно.
Ця стаття — відсутній розділ Всередині чотирьох пайплайнів перекладу, на яких працює InterMIND: той матеріал пояснював, як аудіо стає перекладеним аудіо. Ця стаття — про те, чий голос звучить на іншому кінці.
Стандарт, який постачають усі, і чому він звучить плоско
Якщо ви користувалися живим перекладом на будь-якій із великих платформ для мітингів, ви знаєте цей звук. Нейтральний, рівномірний голос читає переклад. Це той самий голос, незалежно від того, чи промовляє ваш CEO, відкриваючи загальні збори, чи колега, який жартує. Технологія під капотом — це перетворення тексту на мовлення з однією фіксованою моделлю голосу, а проєктне припущення полягає в тому, що зрозумілості достатньо.
На справжньому мітингу — ні. Половина того, що комунікує мітинг, — це хто говорить і як. Якщо прибрати голос, ви перетворюєте дискусію на стенограму, яку просто озвучують вголос. Люди перестають реагувати одне на одного і починають чекати своєї черги.