同時翻訳:ブース通訳、RSI、AI──そしてあなたのミーティングに適したツールは(2026年)
多くの人が検索するときに使うのは「同時翻訳」という言葉だが、業界がこの作業を呼ぶときは「同時通訳」という。両者は同じものを指す:発話が行われているその最中に、途切れることなく、中継も挟まずに、別の言語で再現される、というものだ。しかし、この一つの言葉の下には、実現方法がまったく異なる三つの形態──ブースに入る人間の通訳者、リモート同時通訳(RSI)、そしてリアルタイムAI翻訳──が隠れており、予算規模もまったく異なる。
本ガイドではこの三つを整理した上で、具体的なツールを検証可能な基準で比較する:各ベンダーの公開文書が明記している内容を、出典と確認日とともに示す。私たちはこの三つのうちの一つ(InterMIND)を開発しており、それが適する場面と適さない場面の両方を述べる。
同時翻訳の三つの形態
1. ブースに入る通訳者(歴史的な標準)
言語ペアごとに通訳者2名、防音ブース、会場用の受信機。国際機関や大規模カンファレンスはこの方式を採用している。品質は、文脈や皮肉、専門用語を理解できる専門家によってもたらされる──そしてコストも同じところから生じる:資格を持つ人材を、言語ペアごとに日単位で確保し、さらに機材が必要になる。毎週の定例ミーティングにこの体制を当てはめることは、そもそも想定されていない。
2. RSI:リモートの人間通訳者
リモート同時通訳(RSI)プラットフォーム(Interprefy、KUDO、Boostlingo)は、人間の通訳者による音声を──場合によってはAIオプションと併用して──会場やビデオ通話の参加者のスマートフォンやヘッドセットに配信する。この体制は依然としてイベント型のままだ:一人の話者、一つの聴衆、事前に固定された言語、そして事前予約された通訳者。
3. AI同時翻訳
ここには通訳者がいない:音声認識→機械翻訳→音声合成というカスケードが、数秒以内に各リスナーの言語で発話を再現し、事前予約は一切不要だ。これは、通常のミーティングに見合う限界コストを持つ唯一の形態であり、このカテゴリーの転換点でもある。そこで問われるのは:そのツールは音声以外に何を翻訳するのか、という点になる。