Kendi sesinizle konuşun — konuşmadığınız bir dilde
Gerçek zamanlı çevirinin neredeyse herkesin yanlış anladığı ve neredeyse kimsenin konuşmadığı kısmı burada: duyduğunuz ses.
Mükemmel konuşma tanıma ve mükemmel çeviriye sahip olabilirsiniz, ancak yine de bir makinenin liste okuduğunu hissettiren bir toplantıyla sonuçlanabilirsiniz. Çünkü son adım — çevrilmiş metni tekrar sese dönüştürme — çoğu aracın sizi sessizce tek bir genel sentetik anlatıcıyla değiştirdiği yerdir. Odadaki sekiz kişi, hepsi için tek bir robot ses. Kimin konuştuğunu, vurguyu, kişiliği kaybedersiniz. Anlaşılır, ama bir sohbet değil.
InterMIND bu son adımı farklı yapar. Siz konuştuğunuzda, diğer katılımcılar çeviriyi kolayca tanınan sizin sesinizle duyarlar — tınınızı ve konuşma tarzınızı taşıyan, şimdi ise kelimeleri kendi dillerinde söyleyen bir ses. Henüz kusursuz bir taklit değil; önemli olan siz olmanızdır, hazır bir anlatıcı değil, ve gitgide daha iyi hale geliyor. Bu, her katılımcı için her iki yönde aynı anda çalışır.
Bu yazı, InterMIND'ı çalıştıran dört çeviri hattının içi başlıklı yazının eksik bölümüdür: o yazı, sesin nasıl çevrilmiş ses haline geldiğini açıklıyordu. Bu yazı ise diğer uçtan kimin sesinin çıkacağı hakkındadır.
Herkesin sunduğu varsayılan ve neden tek düze olduğu
Büyük toplantı platformlarından herhangi birinde canlı çeviri kullandıysanız, o sesi bilirsiniz. Nötr, eşit tempolu bir ses çeviriyi okur. Konuşmacı CEO'nuz bir genel toplantı açıyor veya bir meslektaşınız şaka yapıyor olsa da bu ses aynıdır. Altındaki teknoloji, tek bir sabit ses modeline sahip metin-konuşma (text-to-speech) teknolojisidir ve tasarım varsayımı anlaşılabilirliğin yeterli olduğudur.
Gerçek bir toplantıda öyle değildir. Bir toplantının ilettiği şeyin yarısı kimin söylediği ve nasıl söylediğidir. Sesi çıkardığınızda bir tartışmayı yüksek sesle konuşulan bir dile çevrilmiş bir metne dönüştürmüş olursunuz. İnsanlar birbirlerine tepki vermeyi bırakır ve sıralarını beklemeye başlarlar.