虚假流利度陷阱:何时“勉强够用”的英语比完全不懂英语更糟

航空监管机构在特内里费岛和阿维安卡事件后强制推行了这一规定。医学文献将其量化到每位患者就诊的错误次数。四十年的国际商业研究记录了董事会议室中相同的机制。为什么在共同语言中的部分流利度比完全没有共同语言更糟——附数据。

The Mind.com Team

虚假流利度陷阱:何时“勉强够用”的英语比完全不懂英语更糟

虚假流利的陷阱:"过得去"的英语为何比完全不懂英语更糟糕

太长不看版 —— 对一门语言一知半解,比完全不懂它更糟糕。

完全不懂反而让差距显而易见:全场会就此达成共识,安排一位传译员,并围绕这一安排重新组织工作。
一知半解却会掩盖差距:听起来流利但实则有误的表述会被记录为"已达成一致";其代价会在数周后的合同审查中才浮出水面。

航空监管机构在2008年就针对这一机制采取了行动。医学研究从2003年起就在统计它。而董事会会议室,至今还没有。

如今,几乎每一场跨境会议都默认使用一种没有人完全掌握的共同语言——几乎总是英语。这种安排感觉是可行的。本文接下来的内容,就是证明它远没有人们想象的那么可行——证据来自三个各自独立的研究领域(航空安全、医学传译、国际商务研究),并会诚实地回应迄今为止最有力的反方观点(外语效应)。


会议室里,有多少人是在用第二语言交流?

在全世界约15亿英语使用者中,约有4亿人是母语使用者;其余11亿人是将英语作为第二语言或附加语言习得的(David Crystal,《英语作为全球语言》,剑桥大学出版社,第2版,2003年;Ethnologue语言使用者估计数据)。在任何一场跨境商务会议中,这一比例通常都比全球平均水平更为悬殊,因为在专业场合中英语使用者的占比本就偏高。

EF英孚教育每年发布一份覆盖100多个国家的英语熟练度指标。该指标将"极高熟练度"定义为能够*"在社交、职业和学术场合中使用细致入微的语言"的能力。而这恰恰是大多数被统计人群达不到*的门槛。多数国家处于"中等"区间;"高"和"极高"仅集中在少数北欧国家和几个东亚经济体中。

实际上,全球商务会议的参与者,其英语水平大多处于欧洲共同语言参考框架中的B1到C1之间——足以应付日常对话,但不足以在不产生信息损耗的前提下讨论合同条款、监管细节或技术边界问题。

本文接下来要讨论的,正是这部分人群。


失败模式一——虚假精确性

听起来流利的非母语表达,是这一领域中代价最高的失败模式,因为它消除了"需要核实"这一信号。

Lev-Ari 与 Keysar 的研究显示,听众会认为带有非母语口音传达的信息可信度更低,即便内容完全相同、说话者只是在照稿宣读(Why don't we believe non-native speakers?,《实验社会心理学期刊》,2010)。这种偏见是自动产生的、稳固的,且是单向的。

而这一偏见的另一面,在商业场景中代价更高。当一位非母语使用者说出一句听起来流利的话——语法正确、语调自然——听者就会假设理解是对称的:说话者理解周围讨论的程度,与其说出自己那句话时表现出的流利程度相当;听者理解说话者的程度,也与说话者表达出的流利程度相当。而这两个假设通常都是错的。

Tenzer、Pudelko 与 Harzing 对15个跨国团队的员工进行调查后发现,感知到的语言熟练度会系统性地夸大信任判断,而这种被赋予的能力常常名不副实(The impact of language barriers on trust formation in multinational teams,《国际商业研究期刊》,2014)。

会议室里的实际机制是这样的:

  • 说话者说出一句语法正确、但含义偏差了15%的话。
  • 听众听到的是流利,而不是那15%的偏差。
  • 没有人提出澄清问题,因为这句话"听起来没问题"。
  • 这15%的偏差,就这样被写入会议纪要,标注为"已达成一致"。

一句自信满满却有误的表述,比一处明显的空白更危险,因为**空白会引来追问;而虚假的清晰则会被直接记入纪要。**这就是虚假精确性——在共享一种不完美英语环境中运作所付出的根本代价。


失败模式二——细微差别的自我审查

在会议室里,最可能知道答案的人,往往也是最不擅长用工作语言表达出来的人。

Volk、Köhler 与 Pudelko 梳理了关于跨国企业中第二语言处理的认知神经科学文献,报告称专业人士在使用非母语工作时,其工作记忆、处理速度和情绪调节都会承受可测量的额外负荷(Brain drain: The cognitive neuroscience of foreign language processing in multinational corporations,《国际商业研究期刊》,2014)。在这种负荷下,最先消失的正是细微差别——那些限定语、委婉措辞、条件从句和反驳意见,母语使用者无需思考便能自如运用。

国际商务研究文献记录了这一现象的具体表现:那些若用母语发言便能在会议中占据主导地位的资深专家,一旦被迫用英语发言,就会变成全场最沉默的人(Tsedal Neeley,《全球商业讲英语》,《哈佛商业评论》,2012;Neeley,《全球成功的语言》,普林斯顿大学出版社,2017)。他们并非无话可说才沉默。他们沉默,是因为用英语表达真实看法的代价——找到正确的动词时态、既要委婉又不能显得回避、既要有所保留又不能显得软弱——已经超过了保持沉默的代价。

于是,最终做决定的,是那个能够流利表达的人。而这个人往往不是最了解情况的人。

Hinds、Neeley 与 Cramton 将这一现象称为语言避雷针:语言熟练度成为地位的代理指标,而地位决定了谁可以发言(Language as a lightning rod,《国际商业研究期刊》,2014)。会议室里最懂行的人,变成了最不善言辞的人。


失败模式三——流利度凌驾于权威之上

在任何一场以共享英语进行的谈判中,以英语为母语的一方在实质内容交换之前就已经占据优势。非母语一方要分出一部分认知资源用于语言产出,而母语一方可以把全部认知资源都投入到实质内容上。

这是一种可测量的处理能力不对称,而非性格差异。前文提到的神经科学综述报告显示,同一个人在使用第二语言而非母语完成同等任务时,工作记忆会出现大约20%–30%的损耗。换算到真实谈判场景中:非母语一方可能只能调用约70%的认知资源,而母语一方可以全力以赴。

可见的后果,并不是非母语一方发言更少。而是非母语一方**让步更多。**限定语逐渐消失,"我想我们大概可以考虑一下"会直接简化为"好的"。母语一方得到了自己想要的措辞;非母语一方则觉得自己已经基本争取到了想要的结果;而这中间的差距,要等到数周后的合同审查时才会显现。

这正是语言税中最难当场察觉、事后修复代价也最高的部分。


最有力的证据:"过得去"的英语确实能致命

上述三种失败模式在研究文献中已有充分证实,但持怀疑态度的读者仍可能将其视为关于"感受"的软科学结论。这一论点最有力的证据,来自两个已经将第二语言英语与硬性结果进行对照测量的领域——而且监管机构已经根据数据采取了行动。

航空业——国际民航组织对这一问题的监管

1977年3月27日,特内里费。一架荷航747与一架泛美747在洛斯罗德奥斯机场跑道上相撞,583人遇难——至今仍是航空史上最严重的事故。调查确认了多项诱因,其中包括一次非标准的无线电通话。荷航机长范赞滕当时用第二语言英语、在巨大时间压力下,对塔台说出"we are now, uh, at takeoff"(我们现在,呃,正在起飞)。塔台回应了一句"OK"。范赞滕这句话存在歧义,既可理解为*"我们处于起飞位置",也可理解为"我们正在起飞过程中"*;而同样以英语为第二语言的泛美机组当时仍在跑道上。此后,国际民航组织及各国民航当局推行改革,引入标准化通话用语,专门消除这类歧义(西班牙航空当局最终报告;SKYbrary案例研究)。

1990年1月25日,哥伦比亚航空052号航班。一架波音707因燃油耗尽在纽约科夫内克附近坠毁,73人遇难。该机组使用第二语言英语与纽约空管通话时,报告称"running out of fuel"(燃油快用完了)——这一表述并非国际民航组织标准通话用语,空管方面也未将其理解为宣告紧急状态。标准用语"fuel emergency"(燃油紧急情况)或*"minimum fuel"*(最低燃油)从未被使用。美国国家运输安全委员会的最终报告将机组未使用标准通话用语列为可能原因之一(NTSB事故报告 AAR-91/04)。

监管机构的回应。2003年,国际民航组织通过了语言熟练度要求(LPR)——纳入附件1(人员执照)和附件10(航空电信)——将经认证的英语熟练度列为全球国际飞行机组及空中交通管制员的执照要求。该规定设定了六级评分标准;4级("操作级")为国际运行的最低要求。未达到4级,相应执照不得用于国际飞行。实施截止日期为2008年3月(国际民航组织9835号文件,《国际民航组织语言熟练度要求实施手册》)。

监管机构在这里的判断逻辑,正是本文的核心论点,只不过它被写进了具有约束力的国际法:在高风险沟通场景中,"过得去"水平的非母语英语是不安全的;要么所有人都达到规定的操作标准,要么就不能上机执飞。

医学——可量化对比的领域

另一个拥有硬性结果数据的领域是医学传译,在这里,对比甚至更加清晰:同一次临床诊疗,同一位患者,有传译员与没有经过培训的传译员之间的差异。

Glenn Flores 及其同事对两家儿科急诊室中57次西班牙语限英语能力患者的就诊过程进行了录音,统计了每一次传译错误及其潜在临床后果(Flores等,Errors of medical interpretation and their potential clinical consequences: a comparison of professional versus ad hoc versus no interpreters,《急诊医学年鉴》,2012)。

主要发现:

  • 在57次就诊中,共发现1,884处传译错误。
  • 18%的错误存在潜在临床后果。
  • 当使用接受过≥100小时培训的专业传译员时,具有临床后果的错误率降至12%。
  • 使用培训时长<100小时的专业传译员时,这一比例为22%;使用临时传译员(家属、未经培训的双语员工)时为20%;完全不使用传译员时同样为20%。

这里有两点值得解读。第一:由听起来流利但未经专业训练的双语人员担任临时传译,其临床后果错误率并不优于完全不使用传译员。流利程度并不会转化为那些真正重要环节的准确性。第二:只有当传译跨越某个明确的培训门槛后,保护效应才会显现——这与国际民航组织4级标准完全是同一种监管模式。在这组数据中,并不存在"过得去"这样的中间档位。要么跨过门槛,要么没有。

同一作者更早的研究在基层医疗场景中已经发现了同样的规律(Flores等,Errors in medical interpretation and their potential clinical consequences in pediatric encounters,《儿科学》,2003)。2012年的研究则进一步以一个明确的能力标准对其进行了量化。

这对董事会意味着什么

董事会会议室既不是驾驶舱,也不是急诊室。每分钟的风险更低;后果往往在数月后才显现,而非数秒内;代价体现为金钱和声誉的损失,而非生命。

但其中的机制是完全相同的。一位非母语使用者在共享的不完美语言环境中,说出了一句听起来流利、但语义内容已经发生偏移的话;听者将这种流利度当作准确性的信号接收;偏差在表达的那一刻并未被察觉;只有当建立在这一偏差之上的成果——流程、调度指令、合同条款——被付诸实施、与现实发生碰撞时,才会暴露出其含义与会议室里所有人原本理解的并不一致。

航空业与医学之所以与董事会议题相关,是因为它们是仅有的两个将这一机制运行代价加以量化、并由监管机构认定为不可接受的领域。它们正是验证本文论点的天然实验场。


商业领域的代价——数据所在之处

商业领域没有像特内里费空难或Flores研究那样具有同等科学严谨性的案例。它拥有的是自我报告、机制混杂、但规模可观的调查数据。

**经济学人智库,2012年。**一项覆盖51个国家、超过500名高级管理人员的调查——《跨境竞争:文化与沟通障碍如何影响商业》。其中的主要发现包括:

  • 49%的受访者表示,误解曾阻碍重大国际交易,给公司造成重大损失。
  • 64%的受访者表示,语言和文化差异使他们难以在陌生市场立足。
  • 67%的受访者表示,沟通不畅正在妨碍其国际业务拓展。

该报告并未将"语言方面的沟通不畅"与"文化方面的沟通不畅"清晰区分开来,但对于报告重大交易失败的那一半受访者而言,其代价是真实存在的,即便内部机制是混合的。商业领域的文献缺乏医学领域那种"有传译员对照无传译员"的受控比较,也缺乏航空领域那样的监管保障——但其背后的机制,正是更为严谨的研究文献早已确认的那一种。


"使用第二语言,难道不会让人做出更好的决策吗?"

对本文论点最有力的反驳,来自外语效应——由芝加哥大学的 Keysar、Hayakawa 与 An 所证实(The Foreign-Language Effect: Thinking in a Foreign Tongue Reduces Decision Biases,《心理科学》,2012)。他们的实验显示,当人们用第二语言思考经典决策理论问题——框架效应、损失厌恶、亚洲疾病问题——时,所表现出的标准认知偏差比用母语思考同一问题时更小。后续研究已经在多个语言组合和决策偏差范式中复现了这一效应(另见 Costa 等,《认知》,2014)。

这是一个真实存在的发现。那么它为什么不能推翻本文的论点?

原因有三:

  1. **外语效应研究的是个人推理,而非多方沟通。**Keysar 等人测量的是:一个人独自在脑海中、用第二语言、在没有听众、没有沟通对象的情况下思考一个问题时会发生什么。本文中的三种失败模式,都是互动的属性——虚假精确性、自我审查以及流利度凌驾于权威之上的现象,之所以存在,恰恰是因为会议室里不止一个人。外语效应根本不涉及这个领域。
  2. **这一效应作用于情绪/直觉层面的偏差,而非语义准确性。**其机制在于,第二语言会让人与问题的表述框架之间产生情感距离,从而促使人转向更偏分析性的(系统2)思考方式。这对降低损失厌恶有帮助,但对准确传达一条合同条款、不产生语义偏移而言毫无用处——而这恰恰是董事会会议室里真正要做的事。
  3. **航空和医学监管机构早已权衡过这两种效应。**国际民航组织和医学传译领域的文献都清楚第二语言推理方面的研究成果。但这两个领域都没有认为"降低偏差"所带来的好处足以抵消"虚假精确性"的代价。两者都选择了相反的方向:制定熟练度标准并强制执行,对未达标者要求配备传译员或使用标准化通话用语。

诚实的结论是:使用第二语言,会让你——独自在脑海中——在某些框架类任务上变得稍微理性一些。但它会让你所在的会议室在准确传递信息方面的能力下降。外语效应是个人认知的属性;本文提到的三种失败模式则是多方沟通的属性。两者并不能相互抵消。


为何"过得去"的机器翻译无法解决这些问题

在一场英语会议之上简单叠加一层通用机器翻译,并不能解决上述任何一种失败模式,在某些配置下甚至会让情况变得更糟:

  • **虚假精确性会叠加放大。**一个"过得去"的机器翻译层同样会输出听起来流利的内容,而这又叠加在本就流利但不准确的非母语英语之上。两层未经核实的流利表达,使源意图与听者理解之间的距离进一步拉大。
  • **自我审查依然存在。**如果会议的工作语言仍是英语,而翻译只服务于听者,那么说话者依然要承受第二语言带来的认知成本。他们依然会省略掉细微差别。翻译管道只是忠实地保留了这种信息损耗。
  • **流利度—权威的落差被转移,而非被消除。**一个调校不佳的翻译层,只是把优势转移给了拥有更好翻译引擎的一方,而不是转移给真正懂行的人。

真正的解决方案,不是"在英语会议上叠加翻译",而是取消"任何参会者都必须使用自己并非完全掌握的语言"这一前提要求。这是一种不同的架构选择——也正是我们正在构建的方向。


当每位参会者都用母语发言时,会发生什么变化

这种结构性变化说起来简单,做起来却很难:

  1. 每位参会者都使用自己的母语发言——没有第二语言带来的认知负荷,没有细微差别的流失,也没有自我审查。
  2. 每位参会者都能以自己的母语听到其他每一位参会者的发言,延迟低于一秒,语气得以保留。
  3. 翻译层是可审计的:源语言表述、目标语言表述、各语言版本的文字记录以统一方式导出,各语言对的翻译质量经过测量并每月基于真实流量数据公开,而非仅仅作为一个营销数字被宣称。

上述三种失败模式,都指向同一个根源——会议室里有人不得不使用一种自己并未完全掌握的共享语言。消除这一前提,就能一并消除这三种失败模式。而在这一前提之上叠加翻译,则做不到这一点。

这正是下一代跨境会议工具必须接受检验的标准。航空监管机构没有接受"大家英语说得还不错"作为答案。医学监管机构同样没有接受。董事会会议室,不应该是最后一个仍然相信"过得去就行"的地方。


延伸阅读

以下是本文主要依据的资料来源,大致按使用顺序排列:

关于认知与社会机制

航空领域

医学领域

商业领域

  • Economist Intelligence Unit. (2012). Competing across borders: How cultural and communication barriers affect business. Sponsored by EF Education First.

人口数据

  • Crystal, D. (2003). English as a Global Language (2nd ed.). Cambridge University Press.
  • EF Education First. English Proficiency Index (annual).

—— Mind.com 团队

航空业在2008年就已给出答案。医学领域已经统计了二十年。董事会会议室,是最后一个仍在假装"过得去就行"的地方。

实时翻译的更多内容

实时翻译下的所有文章
土耳其语语音翻译器:动词最后出现,这决定了您需要哪一款
实时翻译

土耳其语语音翻译器:动词最后出现,这决定了您需要哪一款

土耳其语将动词——以及否定和时态——放在句子末尾。单凭这一事实,即可区分作为“语音翻译器”出售的三类产品:手机应用、翻译耳机和实时会议翻译。它们各自能对土耳其语句子做些什么、不能做什么,以及为什么供应商支持的语言数量对此毫无参考价值。

The Mind.com Team

同声传译员:人工、远程同声传译平台还是 AI —— 您的多语言会议需要哪种(2026)
实时翻译

同声传译员:人工、远程同声传译平台还是 AI —— 您的多语言会议需要哪种(2026)

“同声传译员”是一种职业;大多数搜索的真正诉求是发言时实时的另一种语言语音。本指南将同传译员室、远程同声传译平台与 AI 同声传译区分开来,基于文档对各工具进行对比 —— Interprefy、KUDO、Wordly、DeepL Voice、Zoom、Teams、Google Meet、InterMIND —— 并探讨了这些对比忽略的问题:会议内容实际有多少被翻译成您的语言,以及数据在哪里运行。

The Mind.com Team

同声传译:同传箱、远程同声传译(RSI)还是 AI —— 以及适合您会议的工具(2026)
实时翻译

同声传译:同传箱、远程同声传译(RSI)还是 AI —— 以及适合您会议的工具(2026)

“同声传译”涵盖三种实际情况:同传箱中的口译员、远程同声传译(RSI)以及实时 AI 翻译。本指南将这三者区分开来,对比了有据可查的工具 —— Interprefy、KUDO、Wordly、DeepL Voice、Zoom、Teams、Google Meet、InterMIND —— 并提出了那些对比文章所回避的问题:会议内容中究竟有多少能真正翻译成您的语言?

The Mind.com Team

通过电子邮件获取新文章和产品更新

每月一封电子邮件,包含新文章和产品更新。随时可取消订阅。