সমকালীন দোভাষী: মানুষ, RSI প্ল্যাটফর্ম, নাকি AI — আপনার বহুভাষিক মিটিংয়ের জন্য কোনটি দরকার (২০২৬)
"সমকালীন দোভাষী" একটি পেশা: একজন মানুষ কথা বলার সময়েই তা অন্য ভাষায় রূপান্তর করেন — কোনো বিরতি নেই, কোনো রিলে নেই। এই শব্দটি যাঁরা খোঁজেন, তাঁদের বেশিরভাগের আসল প্রয়োজন ফলাফলটি। ২০২৬ সালে সেটি পাওয়ার তিনটি সম্পূর্ণ আলাদা উপায় আছে: বুথে বসা দোভাষী, দূরবর্তী দোভাষীসহ RSI প্ল্যাটফর্ম, এবং AI সমকালীন অনুবাদ। এই তিনটির খরচের কাঠামোর মধ্যে কোনো মিল নেই।
এই গাইডে তিনটিকে আলাদা করা হয়েছে। তারপর নামী টুলগুলোকে যাচাইযোগ্য ভিত্তিতে তুলনা করা হয়েছে: প্রতিটি ভেন্ডরের প্রকাশ্য ডকুমেন্টেশনে কী বলা আছে, তার উৎস এবং আমরা কবে দেখেছি সেই তারিখসহ। এগুলোর একটি আমরাই তৈরি করি (InterMIND) — সেটি কোথায় মানানসই আর কোথায় নয়, তা আমরা খোলাখুলি বলব।
সমকালীন দোভাষী সেবা পাওয়ার তিনটি উপায়
১. বুথে বসা দোভাষী
প্রতিটি ভাষা-জোড়ার জন্য দুইজন দোভাষী, একটি শব্দনিরোধক বুথ এবং হলের জন্য রিসিভার। প্রতিষ্ঠান ও বড় সম্মেলনগুলো এভাবেই কাজ করে। মান আসে এমন পেশাদারদের কাছ থেকে যাঁরা প্রসঙ্গ, বিদ্রূপ ও পরিভাষা বোঝেন। খরচও আসে একই জায়গা থেকে: দক্ষ মানুষ, দিন হিসেবে বুক করা, প্রতিটি ভাষা-জোড়ার জন্য আলাদা, সঙ্গে সরঞ্জাম। সাপ্তাহিক কাজের মিটিংয়ের জন্য এই মডেল তৈরিই হয়নি।
২. RSI: মানুষ দোভাষী, দূর থেকে
রিমোট-সমকালীন-দোভাষী (RSI) প্ল্যাটফর্মগুলো (Interprefy, KUDO, Boostlingo) মানুষ দোভাষীর অডিও অংশগ্রহণকারীদের ফোনে বা হেডসেটে পৌঁছে দেয়, কখনও পাশাপাশি AI বিকল্প সহ। এটি সরাসরি উপস্থিত অনুষ্ঠানে হতে পারে, ভিডিও কলেও হতে পারে। ফরম্যাটটি তবু একটি ইভেন্টই থাকে: একজন বক্তা, একদল শ্রোতা, আগে থেকে ঠিক করা ভাষা, বুক করা দোভাষী।
৩. AI সমকালীন অনুবাদ
এখানে কোনো দোভাষী নেই। স্পিচ-রিকগনিশন → মেশিন-ট্রান্সলেশন → স্পিচ-সিনথেসিস ক্যাসকেড কয়েক সেকেন্ডের মধ্যে প্রতিটি শ্রোতার ভাষায় বক্তব্য পৌঁছে দেয়, কিছু বুক করতে হয় না। শুধু এই ধরনেরই প্রান্তিক খরচ সাধারণ মিটিংয়ের সঙ্গে খাপ খায়, এটাই এই বিভাগের টার্নিং পয়েন্ট। তাই প্রশ্নটি বদলে যায়: কণ্ঠস্বরের বাইরে টুলটি আর কী অনুবাদ করে?