Mluvte vlastním hlasem – v jazyce, kterým nemluvíte
Tady je ta část překladu v reálném čase, kterou téměř všichni dělají špatně a o které téměř nikdo nemluví: hlas, který slyšíte.
Můžete mít vynikající rozpoznávání řeči i vynikající překlad a přesto skončit se schůzkou, která působí jako stroj předčítající seznam. Poslední krok, tedy převod přeloženého textu zpět na zvuk, je totiž místo, kde většina nástrojů tiše nahradí vás jedním univerzálním syntetickým vypravěčem. Osm lidí v místnosti a jeden robotický hlas pro všechny. Ztrácíte, kdo právě mluví, důraz i osobnost. Je to srozumitelné, ale není to konverzace.
InterMIND dělá poslední krok jinak. Když mluvíte, ostatní účastníci slyší překlad hlasem, který je rozpoznatelně váš – nese vaši barvu hlasu a váš způsob řeči – a říká slova v jejich jazyce. Zatím to není bezchybná imitace. Jde o to, že je to váš hlas, a ne anonymní vypravěč, a stále se zlepšuje. Funguje to pro každého účastníka, v obou směrech, současně.
Tento článek je chybějící kapitola k textu Inside the four translation pipelines that run InterMIND: tamten vysvětloval, jak se zvuk mění na přeložený zvuk. Tento je o tom, čí hlas na druhém konci zazní.
Výchozí řešení, které dodávají všichni, a proč je ploché
Pokud jste někdy použili živý překlad v některé z velkých platforem pro schůzky, znáte ten zvuk. Neutrální, rovnoměrně zpomalený hlas čte překlad. Je to stejný hlas, ať už mluví váš generální ředitel při zahájení firemního setkání, nebo kolega, který vypráví vtip. Pod povrchem je převod textu na řeč s jedním pevným hlasovým modelem a předpokladem, že srozumitelnost stačí.
Na skutečné schůzce nestačí. Polovina toho, co schůzka sděluje, je kdo to říká a jak. Odeberte hlas a z diskuse se stane přepis, který se náhodou čte nahlas. Lidé přestanou reagovat jeden na druhého a začnou jen čekat, až na ně přijde řada.