Өз даусыңызбен сөйлеңіз — өзіңіз білмейтін тілде
Нақты уақыттағы аудармада барлығы дерлік қателесетін және ешкім айтпайтын бір тұс бар: сіз еститін дауыс.
Сөйлеуді тану да, аударма да өте жақсы болуы мүмкін, бірақ кездесу бәрибір машина тізімді оқып тұрғандай әсер қалдырады. Себебі соңғы қадамда, аударылған мәтінді қайта дыбысқа айналдырғанда, көптеген құралдар сізді тыныш қана бір жалпы синтездік дикторға ауыстырады. Бөлмеде сегіз адам отырса да, бәріне бір ғана робот дауысы беріледі. Кім сөйлеп тұрғаны, екпін, мінез жоғалады. Түсінікті, бірақ әңгіме емес.
InterMIND соңғы қадамды басқаша жасайды. Сіз сөйлегенде, басқа қатысушылар аудармаңызды сізге тән дауыспен естиді: сіздің тембріңіз бен сөйлеу мәнеріңіз сақталады, тек сөздер олардың тілінде айтылады. Бұл әлі мінсіз ұқсастық емес. Мәселе — дайын дикторға емес, дәл сізге ұқсауында, және ол жақсарып келеді. Бұл әр қатысушы үшін, екі бағытта да, бір мезгілде жұмыс істейді.
Бұл жазба — Inside the four translation pipelines that run InterMIND мақаласының жетіспейтін тарауы: ол жазбада аудио қалай аударылған аудиоға айналатыны түсіндірілген. Ал мына жазба — ең соңында кімнің дауысы шығатыны туралы.
Бәрі қолданатын әдепкі нұсқа және оның неге бір қалыпты екені
Үлкен кездесу платформаларының кез келгенінде тікелей аударманы қолданған болсаңыз, дыбысты білесіз. Бейтарап, бірқалыпты қарқынды дауыс аударманы оқиды. Спикер — жалпы жиналысты ашып тұрған бас директор ма, әлде әзіл айтып жатқан әріптес пе, дауыс бірдей. Астарындағы технология — бір тіркелген дауыс моделі бар мәтінді-сөйлеуге айналдыру (text-to-speech), ал дизайнның болжамы: түсінікті болса, жеткілікті.
Нақты кездесуде олай емес. Кездесуде жеткізілетін ақпараттың жартысы — оны кімнің және қалай айтып тұрғанында. Дауысты алып тастасаңыз, талқылау дауыстап оқылатын стенограммаға айналады. Адамдар бір-біріне жауап беруді қойып, өз кезегін күте бастайды.