সমকালীন অনুবাদ: বুথ, RSI, নাকি AI — এবং আপনার মিটিংয়ের জন্য কোন টুল (2026)
"সমকালীন অনুবাদ" শব্দটিই সবাই সার্চ করে; পেশাদার মহলে একে বলা হয় "সমকালীন ইন্টারপ্রিটেশন"। দুটো নামই একই জিনিস বোঝায়: কথা বলার সময়েই অন্য ভাষায় তার রূপান্তর — কোনো বিরতি নেই, কোনো রিলে নেই। কিন্তু এই একটি শব্দের আড়ালে তিনটি সম্পূর্ণ আলাদা পদ্ধতি রয়েছে — বুথে বসা মানুষ দোভাষী, দূরবর্তী সমকালীন ইন্টারপ্রিটেশন (RSI), এবং রিয়েল-টাইম AI অনুবাদ — আর সঙ্গে রয়েছে তিনটি বাজেট, যাদের মধ্যে কোনো মিল নেই।
এই গাইডে প্রথমে তিনটি পদ্ধতিকে আলাদা করা হয়েছে, তারপর নাম ধরে ধরে টুলগুলোর তুলনা করা হয়েছে যাচাইযোগ্য ভিত্তিতে: প্রতিটি ভেন্ডরের প্রকাশ্য ডকুমেন্টেশনে কী বলা আছে, সূত্রসহ এবং আমরা কবে তা দেখেছি সেই তারিখসহ। এগুলোর একটি আমরা নিজেরাই তৈরি করি (InterMIND); সেটি কোথায় মানানসই আর কোথায় নয়, তা-ও আমরা বলব।
সমকালীন অনুবাদের তিনটি রূপ
১. বুথে বসা দোভাষী (ঐতিহাসিক মানদণ্ড)
প্রতিটি ভাষা-জোড়ার জন্য দুইজন দোভাষী, একটি শব্দনিরোধী বুথ, আর কক্ষের জন্য রিসিভার। প্রতিষ্ঠান ও বড় সম্মেলনগুলো এভাবেই কাজ করে। মান আসে এমন একজন পেশাদার থেকে, যিনি প্রসঙ্গ, শ্লেষ ও পরিভাষা বোঝেন — আর খরচও আসে একই জায়গা থেকে: দক্ষ মানুষ, দিন হিসেবে বুক করা, প্রতিটি ভাষা-জোড়ার জন্য আলাদা, সঙ্গে সরঞ্জাম। সাপ্তাহিক কাজের মিটিংয়ের জন্য এই ব্যবস্থা প্রয়োগ করার মতো করে তৈরিই নয়।
২. RSI: মানুষ দোভাষী, দূর থেকে
দূরবর্তী-সমকালীন-ইন্টারপ্রিটেশন প্ল্যাটফর্মগুলো (Interprefy, KUDO, Boostlingo) মানুষ দোভাষীদের অডিও — কখনো পাশে একটি AI বিকল্পসহ — অংশগ্রহণকারীদের ফোন বা হেডসেটে পৌঁছে দেয়, সরাসরি ভেন্যুতে হোক বা ভিডিও কলে। ব্যবস্থাটি তবুও একটি ইভেন্ট-ধর্মী কাঠামো: একজন বক্তা, একদল শ্রোতা, আগে থেকে ঠিক করা ভাষা, বুক করা দোভাষী।
৩. AI সমকালীন অনুবাদ
এখানে কোনো দোভাষী নেই: স্পিচ-রিকগনিশন → মেশিন-ট্রান্সলেশন → স্পিচ-সিনথেসিস ক্যাসকেড প্রতিটি শ্রোতার ভাষায় কয়েক সেকেন্ডের মধ্যে কথাটি রূপান্তর করে, বুক করার কিছুই লাগে না। সাধারণ মিটিংয়ের সীমান্ত-খরচের সঙ্গে খাপ খায় কেবল এই রূপটিই — এটিই এই ক্যাটাগরির মোড় ঘোরানোর বিন্দু। তখন প্রশ্নটা দাঁড়ায়: কণ্ঠস্বর ছাড়া টুলটি আর কী অনুবাদ করে?