リサーチ

「不十分な英語」が「英語ができない」ことより深刻なわけ:偽りの流暢さの罠

テネリフェやアビアンカの事故後、航空規制当局はこれを義務付けた。医学文献では患者とのやり取りごとのエラー数として定量化されている。40年間の国際ビジネス研究は、取締役会でも同じメカニズムが存在することを記録している。共有言語における不完全な流暢さが、共有言語を持たないことよりも悪い理由とそのデータ。

The Mind.com Team

「不十分な英語」が「英語ができない」ことより深刻なわけ:偽りの流暢さの罠

偽りの流暢さの罠:「不十分な英語」が「英語ができない」ことより深刻なケース

TL;DR — 言語を不十分に知ることは、全く知らないことよりも悪い。

知らないことには、ギャップが可視化されるというメリットがある。会議室は通訳の必要性で合意し、それに合わせて体勢を整える。 不十分に知ることは、ギャップを隠してしまう。流暢に聞こえるエラーが「合意事項」として議事録に記録され、数週間後に契約レビューでそのコストが表面化する。

航空規制当局は2008年にこのメカニズムに対処した。医学研究は2003年からこれをカウントしてきた。しかし取締役会はまだ手をつけていない。

今日の国境を越えるすべての会議は、誰も完全には習得していない共有言語、ほとんどの場合は英語をデフォルトとしている。この仕組みは機能しているように感じられる。本投稿の残りの部分は、それが人々が考えるほど機能していないという証拠であり、3つの独立した文献(航空安全、医療通訳、国際ビジネス研究)から引き出され、最も強力な公表された反論(外国語効果)に対する誠実な検証である。


会議室の中で第2言語を使って作業している人はどれくらいいるか?

世界の約15億人の英語話者のうち、約4億人がネイティブであり、残りの11億人は第2または追加言語として英語を学んだ(David Crystal, English as a Global Language, Cambridge University Press, 2nd ed., 2003; Ethnologue speaker estimates)。国境を越えるビジネス会議では、プロフェッショナルな文脈で英語が過大評価されているため、この比率は通常、世界平均よりも悪い。

EF Education Firstは100カ国以上を対象とした年次英語熟練度指数を公表している。そこで定義される「非常に高い熟練度」とは、「社会的、職業的、学術的な状況で、ニュアンスのある言語を使用できること」である。これは、測定されたほとんどの母集団がクリアできないハードルである。中央値の国は「中級」バンドに位置しており、「高」および「非常に高い」レベルは一部の北欧諸国と少数の東アジアの経済圏に集中している。

実際には、世界の平均的なビジネス会議は、共通欧州言語参照枠(CEFR)のB1からC1の間で作業する人々によって構成されている。日常会話をこなすには十分流暢だが、契約書の文言、規制のニュアンス、または技術的なエッジケースを損失なく議論するには十分ではない流暢さである。

これが、本投稿の残りの部分で扱う母集団である。


失敗モード1 — 偽りの精度

流暢に聞こえる非ネイティブの発話は、この領域において最もコストの高い失敗モードである。なぜなら、何かを確認する必要があるというシグナルを消し去るからだ。

Lev-AriとKeysarは、内容が同一でスクリプトを読んでいる場合でも、リスナーが非ネイティブのアクセントで伝えられた情報を信頼性が低いと判断することを示した(Why don't we believe non-native speakers?, Journal of Experimental Social Psychology, 2010)。このバイアスは自動的で、堅牢で、一方向性である。

ビジネスにおいてよりコストが高いのは、同じバイアスの反対の側面である。非ネイティブの話者が流暢に聞こえる文(文法は正しく、イントネーションは自然)を生成した場合、リスナーは理解が対称であると想定する。つまり、話者が周囲の議論を理解した程度は自分の文を生成した程度と同じであり、リスナーが話者を理解した程度も話者が話した程度と同じであると見なす。どちらの想定も日常的に間違っている。

Tenzer、Pudelko、Harzingは15の多国籍チームの従業員を調査し、認知された言語熟練度が信頼の帰属を体系的に増幅し、帰属された能力が常に間違っていることが多いことを発見した(The impact of language barriers on trust formation in multinational teams, Journal of International Business Studies, 2014)。

会議室でのメカニズム:

  • 話者は文法が正しく、意味が15%ずれている文を発する。
  • リスナーはその15%ではなく、流暢さを聞く。
  • 文は「問題なく聞こえた」ため、誰も明確化の質問をしない。
  • 15%のギャップは合意事項として議事録に書き込まれる。

自信に満ちた間違った文は、明らかなギャップよりも危険である。なぜなら、ギャップにはフォローアップの質問が寄せられるが、偽りの明確さは議事録に記録されるからだ。これが偽りの精度であり、不完全な共有英語で作業することの負担となるコストである。


失敗モード2 — ニュアンスの自己検閲

最も答えを知っている可能性が高い人は、作業言語でそれを表現する力が最も低い人であることが多い。

Volk、Köhler、Pudelkoは多国籍企業における第2言語処理の認知神経科学の文献をレビューし、プロフェッショナルが非ネイティブ言語で作業する際、ワーキングメモリ、処理速度、感情調整に測定可能な追加負荷がかかることを報告した(Brain drain: The cognitive neuroscience of foreign language processing in multinational corporations, Journal of International Business Studies, 2014)。その負荷の下で最初に消えるのはニュアンスである。ネイティブスピーカーが無意識に使う限定詞、回避、条件節、反論である。

観察可能な結果は国際ビジネスの文献に記録されている。母国語であれば会議を支配するであろうシニアの専門家が、英語での作業を余儀なくされると会議室で最も静かな人になる(Tsedal Neeley, Global Business Speaks English, Harvard Business Review, 2012; Neeley, The Language of Global Success, Princeton University Press, 2017)。彼らが発言しないのは、付け加えるべき何もないからではない。英語で自分の実際の見解を表現するコスト(適切な時制を見つけ、回避的に聞こえないように曖昧にし、弱々しく聞こえないように条件付けする)が、沈黙しているコストを上回るからである。

その結果、決定は流暢に自己表現ができる人によって下される。一般的に、最も多くを知っている人々ではない。

Hinds、Neeley、Cramtonはこれを避雷針としての言語と呼んだ。言語熟練度がステータスの代理となり、ステータスが誰が話すかを決定する(Language as a lightning rod, Journal of International Business Studies, 2014)。会議室で最も知識のある人が、最も雄弁でない人になる。


失敗モード3 — 流暢さが権威に勝る

共有英語で行われる交渉において、ネイティブ英語の側は、何の実質的なやり取りも行われる前に優位に立つ。非ネイティブの側は認知予算の一部を言語の生成に費やすが、ネイティブの側はそのすべてを実質的な内容に費やす。

これは測定可能な処理の非対称性であり、性格の効果ではない。上記の神経科学のレビューは、同じ人がL1ではなくL2で同等のタスクを実行した場合、ワーキングメモリに約20〜30%のペナルティがかかると報告している。実際の交渉に翻訳すると、非ネイティブの側は認知予算の約70%で実行しているのに対し、ネイティブの側はその100%で実行していることになる。

目に見える結果は、非ネイティブの側が少なく話すことではない。結果は、非ネイティブの側がより多く同意することである。ヘッジは消える。「おそらく検討できると思う」が「OK」に崩れる。ネイティブの側は望んでいた文言を手に入れ、非ネイティブの側は望んでいたもののほとんどを手に入れたと感じるが、そのギャップは数週間後の契約レビューでしか表面化しない。

これが、その瞬間には最も捉えにくく、後から修正するのに最もコストがかかる「言語税」の部分である。


最強の証拠:「不十分な」英語が文字通り命を奪う場合

上記の3つの失敗モードは研究文献で十分に実証されているが、懐疑的な読者はそれらを感情に関するソフトサイエンスの発見として片付けるかもしれない。この提起の最強の証拠は、第2言語の英語がハードな結果に対して測定された2つの領域、そして規制当局がすでにデータに基づいて行動した領域から得られる。

航空 — ICAOが問題を規制したとき

テネリフェ、1977年3月27日。KLMの747とパンナムの747がロス・ロデオス空港の滑走路で衝突した。583人が死亡した。これは現在も航空史上最悪の事故である。調査では、標準的ではない無線のやり取りを含むいくつかの寄与要因が特定された。KLMのVan Zanten機長は、強い時間的制約の中、第2言語の英語で管制塔に"we are now, uh, at takeoff."と伝えた。管制塔は"OK."と応答した。Van Zantenの表現は"we are in the takeoff position"(離陸位置にいる)と"we are in the process of taking off"(離陸過程にある)の間で曖昧であり、同じく第2言語の英語話者であったパンナムの乗務員はまだ滑路上にいた。ICAOや各国当局によるその後の改革は、この種の曖昧さを排除するために標準的な表現を導入した(スペイン航空当局最終報告書; SKYbraryケーススタディ)。

**アビアンカ052便、1990年1月25日。*ボーイング707が燃料を使い果たし、ニューヨーク州コーブ・ネック近郊に墜落し、73人が死亡した。ニューヨークの航空管制(ATC)と第2言語の英語でやり取りをしていた乗務員は、"running out of fuel"(燃料が切れそうだ)と報告した。これはICAOの標準表現には存在しないフレーズであり、ATCはこれを宣言された緊急事態とは解釈しなかった。標準用語である"fuel emergency""minimum fuel"*は一度も使用されなかった。NTSBの最終報告書は、標準表現を使用しなかったことを事故の可能性のある原因の一つとして特定した(NTSB航空事故報告書 AAR-91/04)。

規制当局の対応。2003年、ICAOは語学能力要件を導入した。付録1(人員免許)および付録10(航空通信)であり、国際線乗務員や航空管制官に対して、英語能力の証明を免許要件として義務付けた。6段階の評価尺度が定義され、国際運航においてはレベル4(「運用」)が最低要件となった。レベル4未満の場合、国際飛行の免許は無効である。実施期限は2008年3月であった(ICAO Doc 9835, Manual on the Implementation of ICAO Language Proficiency Requirements)。

ここでの規制当局の理論的根拠は、本投稿のテーゼを拘束力のある国際法に書き込んだものである。「不十分な」レベルの非ネイティブ英語は、高いリスクが伴うコミュニケーションにおいて安全ではない。全員が定義された運用基準の言語を話すか、そうでなければ飛行機を飛ばすことはできない。

医療 — 比較が測定可能なとき

ハードな結果を持つもう一つの領域は医療通訳である。ここでの比較はさらに明確である。同じ診察、同じ患者で、訓練を受けた通訳がいる場合といない場合の比較である。

Glenn Floresと同僚は、2つの小児科救急外来(ED)でスペイン語を話す英語能力が限られた患者との57の救急外来での対応を録音し、すべての通訳エラーとその潜在的な臨床的帰結をカウントした(Flores et al., Errors of medical interpretation and their potential clinical consequences: a comparison of professional versus ad hoc versus no interpreters, Annals of Emergency Medicine, 2012)。

主な発見:

  • 57の対応で1,884件の通訳エラーが特定された。
  • すべてのエラーの18%が潜在的な臨床的帰結を持っていた。
  • 100時間以上の訓練を受けたプロの通訳を使用した場合、臨床的に重大なエラー率は**12%**に低下した。
  • 訓練時間が100時間未満のプロの通訳では22%アドホックな通訳(家族、未訓練のバイリンガルスタッフ)では20%、そして通訳が全くいない場合は**20%**であった。

ここから読み取れるべきことが2つある。第一に、訓練を受けていない流暢なバイリンガル人によるアドホックな通訳は、臨床的帰結の発生率において通訳が全くいない場合と変わらない。流暢さは、重要な部分の正確さにはつながらない。第二に、保護効果は通訳が定義された訓練の閾値を超えた場合にのみ発動する。これはICAOのレベル4と全く同じ規制パターンである。「不十分」というカテゴリはこのデータには存在しない。閾値を超えるか、超えないかのどちらかである。

同じ著者による以前の研究は、すでにプライマリケアでも同じパターンを示していた(Flores et al., Errors in medical interpretation and their potential clinical consequences in pediatric encounters, Pediatrics, 2003)。2012年の研究はそれを定義された能力基準に対して定量化した。

これが取締役会で重要な理由

取締役会はコックピットでもなければ救急外来でもない。1分あたりのリスクは低く、結果は数秒ではなく数カ月で現れ、コストは命ではなく金銭と評判である。

しかし、メカニズムは同一である。共有される不完全な言語で作業する非ネイティブの話者は、意味的内容がずれた流暢に聞こえる発話を発する。リスナーはその流暢さを正確さのシグナルとして受け取る。ギャップは発話の瞬間には検出されず、その上に構築された成果物(手順、出動指令、契約条項)が現実に対して実行され、会議室が信じていたものとは異なる意味を持つことが判明したときにのみ、ギャップは表面化する。

航空と医療が取締役会にとって重要なのは、このメカニズムを動かしたコストが定量化され、規制当局がそれを許容できないと判断した2つの領域だからである。それらはこの提起に対する自然実験である。


ビジネスにおけるコスト — データがある場合

ビジネスには、テネリフェやFloresの研究のような科学的にきれいなものはない。あるのは調査データであり、自己申告に基づき、メカニズムも複雑だが、大規模なデータである。

**エコノミスト・インテリジェンス・ユニット、2012年。**51カ国の500人以上の上級幹部を対象とした調査 — Competing across borders: How cultural and communication barriers affect business. 調査結果の中で次のことが明らかになった:

  • 回答者の49%が、誤解が重大な国際取引の障害となり、会社に重大な損失を招いたと報告した。
  • 64%が、言語と文化の違いが、不慣れな市場に足場を築くことを困難にしていると報告した。
  • 67%が、コミュニケーションの誤りが国際ビジネスの努力を妨げていると報告した。

この報告書は「言語のコミュニケーション不全」と「文化のコミュニケーション不全」をきれいに切り分けていないが、失敗した重大な取引を報告した半数の回答者にとって、内部のメカニズムが混在していてもコストのラインは実在する。ビジネスの文献には、医療が持っているような対照的な「通訳あり vs なし」の比較や、航空が持っている規制のセーフティネットがない。しかし、その根底にあるメカニズムは、よりきれいな文献がすでに解明したものである。


「でもL2で作業すると、人はより良い意思決定者になるのでは?」

本投稿のテーゼに対する最も強力な公表された反論は、シカゴ大学のKeysar、Hayakawa、Anによって実証された外国語効果である(The Foreign-Language Effect: Thinking in a Foreign Tongue Reduces Decision Biases, Psychological Science, 2012)。彼らの実験は、人々が古典的な意思決定理論の問題(フレーミング効果、損失回避、アジア疾病問題)を第2言語で考慮した場合、L1で同じ問題を考慮した場合よりも標準的な認知バイアスが少なくなることを示した。その後の研究は、複数の言語ペアと意思決定バイアスのパラダイムにわたってその効果を再現している(Costa et al., Cognition, 2014も参照)。

これは本物の発見である。では、なぜこれがテーゼを論破しないのか?

3つの理由:

  1. **外国語効果は個人の推論に関するものであり、複数当事者間のコミュニケーションに関するものではない。**Keysarらは、リスナーやコミュニケーションパートナーがいない状態で、自分の頭の中でL2を使って一人で問題を決定したときに何が起こるかを測定した。本投稿の3つの失敗モードはすべて、相互作用の特性である。偽りの精度、自己検閲、流暢さと権威の勾配は、部屋に2人以上の人がいるからこそ存在する。外国語効果はその領域にはまったく入らない。
  2. **この効果は感情的/ヒューリスティックなバイアスに対して働くものであり、意味論的正確さに対してではない。**そのメカニズムは、L2が問題のフレーミングからの感情的距離を作り出し、リスナーがより分析的な(システム2の)処理に依存するようになるというものである。損失回避を減らすのには役立つ。しかし、取締役会が行っているような、意味論的ドリフトなしに契約条項を伝達するのには役立たない。
  3. **航空および医療の規制当局はすでに両方の効果を比較衡量している。**ICAOと医療通訳の文献はどちらも、L2の推論に関する文献が存在することを知っている。しかし、どちらの分野も、バイアス軽減の利益が偽りの精度のコストに値するとは判断しなかった。両方とも逆の道を選んだ。能力基準を定義し、それを強制し、基準に満たないすべての人に通訳者または標準的な表現の使用を要求するという道である。

誠実な要約: L2で作業することは、あなた自身(一人で頭の中で)が特定のフレーミングタスクにおいてわずかに合理的になる。しかし、あなたがいる部屋が情報を正確に伝達する能力を低下させる。外国語効果は個人の認知の特性であり、上記の3つの失敗モードは複数当事者間のコミュニケーションの特性である。それらは打ち消し合わない。


なぜ「不十分な」機械翻訳では何も解決しないのか

英語の会議の上にスロットされた汎用の機械翻訳レイヤーは、3つの失敗モードのいずれも対処せず、一部の構成では悪化させる:

  • **偽りの精度が合成される。**不十分な機械翻訳レイヤーも流暢に聞こえる出力を出すが、今度は流暢に聞こえる非ネイティブ英語の上に重ねられる。検証されていない2つの流暢さのスタックが、ソースの意図とリスナーの理解を切り離す。
  • **自己検閲は持続する。**会議の作業言語が依然として英語であり、翻訳がリスナーにのみ役割を果たす場合、話者は依然としてL2のコストを払う。彼らは依然としてニュアンスを落とす。翻訳パイプラインはその損失を忠実に保存する。
  • **流暢さと権威の勾配は反転するが、平坦にはならない。**調整の不十分な翻訳レイヤーは、単に最も多くを知っている人ではなく、最も良いエンジンを味方に持つ人に優位を移すだけである。

修正策は「英語の会議の上に翻訳を追加する」ことではない。修正策は、いかなる参加者も完全には習得していない言語で作業するという要件をなくすことである。それは異なるアーキテクチャの選択であり、我々が目指して構築しているものである。


すべての参加者が母国語を話すときに何が変わるか

構造的な変化は説明は簡単だが、エンジニアリングは難しい:

  1. すべての参加者は自分自身の母国語を話す — L2の認知負荷なし、ニュアンスの欠落なし、自己検閲なし。
  2. すべての参加者は、他のすべての参加者を自分自身の母国語で聞く。サブ秒のレイテンシと維持されたトーンで。
  3. 翻訳レイヤーは監査可能である: ソースの発話、ターゲットの発話、言語ごとのトランスクリプトが単一のバンドルとしてエクスポートされ、言語ペアごとの品質はマーケティング上の数字として主張されるのではなく、測定され、毎月実際のトラフィックで公開される

3つの失敗モードはすべて、誰かが共有される不完全な言語で作業するという同じ要件にリンクしている。その要件を取り除くことで、それらは一緒に取り除かれる。その要件の上に翻訳を追加しても取り除かれない。

これが、次世代の国境を越える会議ツールが測定の基準としなければならない違いである。航空規制当局は「誰もがかなり良い英語を話す」を答えとして受け入れなかった。医療規制当局も同様である。取締役会がこれを行う最後の領域であってはならない。


参考書目

本投稿で負担を支える情報源を、おおよそ使用された順に:

認知および社会的メカニズムについて

航空

医療

ビジネス

  • Economist Intelligence Unit. (2012). Competing across borders: How cultural and communication barriers affect business. Sponsored by EF Education First.

人口

  • Crystal, D. (2003). English as a Global Language (2nd ed.). Cambridge University Press.
  • EF Education First. English Proficiency Index (annual).

— The Mind.com Team

航空は2008年にこれを表明した。医療は20年間これを数え続けてきた。取締役会は、「不十分」で十分だと未だに見て見ぬふりをしている最後の部屋である。

新着記事をメールで受け取る

新しい記事を公開した際にメールでお知らせします。いつでも購読解除できます。