口译与笔译:有什么区别——以及每种口译类型的详解 (2026)
口译是在交流发生时,将口语(或手语)实时转换为另一种语言。笔译是在文本存在之后,将书面文本从一种语言转换为另一种语言。 美国翻译协会将其浓缩为一句话:笔译员负责写,口译员负责说。
这两个词在日常用语中常被混用——“我们需要为会议找一名翻译”几乎总是指口译员——但它们代表着不同的职业、不同的技能、不同的工具,以及不同的采购决策。本指南为您提供了工作定义、并排比较、每种口译类型及其适用场景,以及 AI 目前在其中所处的位置。
什么是口译?
口译是语音的实时语言转换。 口译员聆听一种语言的发言者,并用另一种语言传达其含义——而非逐字文本——这可以在发言者仍在讲话时进行(同声传译),也可以在其句子的停顿间进行(交替传译)。其输出是短暂的:它存在于当下,服务于房间里或通话中的人员,并在会议结束后消失。
因为口译是实时进行的,所以没有修改重来的机会。口译员需要将所有内容——词汇、语气、文化背景、发言者的意图——保存在工作记忆中,并跟上发言者的语速。这就是为什么联合国(其会议以六种官方语言同声传译为其他五种语言)将会议口译视为最具挑战性的语言职业之一,以及为什么专业的同声传译员会两人一组工作,大约每 30 分钟轮换一次。
什么是笔译?
笔译是书面文本的转换。 笔译员处理已经存在的文档——如合同、网站、字幕文件、医疗记录——并生成一份目标语言的全新书面文档。这项工作是在事后进行的,有时间研究术语、查阅参考资料、使用翻译记忆工具并进行修改。其输出是持久的:一份可以审查、认证并重复使用的文本。
那个审查步骤是实际上的分水岭。翻译好的合同在任何人签署之前都可以逐字检查。口译的谈判则不能——这就是为什么这两个职业的认证方式和定价方式不同,以及为什么“我能拿到书面文件吗?”是一个笔译问题,即使会议本身是经过口译的。
口译与笔译:一目了然的区别
| 口译 | 笔译 | |
|---|---|---|
| 媒介 | 口语或手语 | 书面文本 |
| 发生时间 | 实时进行 | 源文本存在之后 |
| 方向 | 同一场会议中通常双向进行 | 每次任务通常单向进行 |
| 交付物 | 短暂的——听过即逝 | 持久的——可审查的文档 |
| 工作时间 | 几秒钟(同声传译)到一个停顿(交替传译) | 几小时到几周,包含修订 |
| 工具 | 隔间/控制台、接收器或平台 | CAT 工具、翻译记忆库、术语表 |
| 忠实度目标 | 语意和意图,跟上讲话语速 | 完全准确,可逐字审查 |
| 典型定价 | 每位口译员每天或每小时计费 | 每个字或每页计费 |
上表直接引出了两个结果。首先,两者的技能几乎没有重叠:一位出色的合同笔译员可能无法为一场会议做口译,反之亦然——雇用一方去做另一方的工作是范畴错误,而非折中方案。其次,机器辅助进入这两个领域的速度不同:文本的机器翻译有数十年的历史,而机器口译——实时语音、双向、以对话语速进行——直到最近才变得切实可行。我们将在下文中介绍这一转变。
口译的类型
“口译的类型”混合了两个值得区分的独立维度:模式(口译本身如何计时并传递给听众)和交付形式(口译员在哪里以及音频如何传递给您)。
模式
| 模式 | 工作原理 | 典型场景 |
|---|---|---|
| 同声传译 | 口译员在发言者仍在讲话时传达发言;听众听到的内容有几秒钟的延迟 | 会议、多语言会议、广播、联合国 |
| 交替传译 | 发言者每隔几句话停顿一下;口译员传达该段落 | 医疗问诊、证词录存、实地考察、访谈 |
| 耳语传译 | 直接向一两位听众低声耳语的同声传译,无需设备 | 在使用另一种语言进行的会议房间中的一名代表或高管 |
| 联络传译(双向) | 口译员在来回交流中交替使用两种语言 | 谈判、陪同访问、小型的双方会议 |
| 视阅传译 | 在现场将书面文档用另一种语言大声读出 | 医疗或法律预约中的表格和信件 |
同声传译是一种可扩展的模式:会议全速进行,任意数量的语言都可以并行运行(每种语言一个频道),听众选择自己的频道。它历史上的成本——隔音间、每种语言两名口译员、日薪——使其成为一种活动日的服务,而不是日常服务。我们为此撰写了一份完整的通俗指南:同声传译:它是什么、如何工作以及 AI 何时能胜任。
交替传译以时间换取简单性:无需设备,但会议耗时大约是原来的两倍,因为所有内容都要说两遍。它在每句话的精确度比语速更重要的场合大放异彩——例如诊断、宣誓声明、大声宣读的合同条款。
耳语传译和联络传译是上述两种模式的小规模变体——之所以值得知道它们的名字,是因为代理商会对其分别报价,但几乎每一个实际的决策都会归结为同声传译还是交替传译。
交付形式
| 形式 | 它是什么 | 它改变了什么 |
|---|---|---|
| 现场 | 口译员亲自到场(在隔间内或在听众旁边) | 传统基准:设置成本最高,房间内需要硬件 |
| OPI — 电话口译 | 口译员通过电话按需加入 | 基于分钟的计费,仅限音频,无视觉语境 |
| VRI — 远程视频口译 | 口译员通过视频通话加入 | 增加了视觉语境(对手语至关重要);在医院中很常见 |
| RSI — 远程同声传译 | 口译员通过平台从中心或家中工作;音频流传输到每个听众的设备上 | 消除了同声传译中的隔间、接收器和差旅 |
| AI 口译 | 语音流水线(识别 → 翻译 → 合成)为每位听众持续进行口译 | 消除了预订和日费率;口译成为一项软件功能 |
这些形式讲述了一个关于成本的故事。现场同声传译是语言服务中最昂贵的配置:每位口译员、每种语言、每天,再加上设备。OPI 和 VRI 使交替传译能够按需获取——一家医院不会为了可能的紧急情况去安排一名他加禄语口译员;它会拨打电话寻找。RSI 对同声传译进行了同样的结构调整:口译员仍然是按日薪计费的专业人士,但隔间、接收器和差旅都不复存在。而 AI 口译消除了剩余的限制——即预订本身——这改变了到底哪些会议能获得口译服务。柏林、圣保罗和东京之间的每周同步会议以前绝对不会为每个语言对预订两名口译员;有了 AI,它就不必这样做了。
您需要哪种类型?
根据情况匹配,而不是根据术语:
- 会议、峰会或多语言活动 → 同声传译。对于核心利害关系和相应预算,采用人工口译(现场或 RSI);对于因隔间预算限制而无法覆盖的会议、分组会议和活动,采用 AI 口译。实际应用中的情况:活动与会议。
- 医疗预约或医患对话 → 交替传译,通常通过 VRI 或 OPI 按需进行;在多个司法管辖区,医疗保健领域配备合格的口译员是法律要求,而非礼貌行为。对于多语言远程医疗和员工会议,AI 口译涵盖了日常层级:医疗保健。
- 工作会议、网络研讨会或定期的跨国通话 → 这是人工口译从未触及的领域(没人会为站会预订隔间),也是AI 同声传译的天然契合点:每位参与者选择一种语言,会议全速进行。
- 法庭听证、宣誓作证或认证程序 → 必须是经认证的人工口译员,毫无商量余地。在口译本身即为法律记录的场合,机器输出不具备资格——如果供应商声称具备,您应该对此保持警惕。
- 一份文档——合同、报告、网站、专利 → 那是笔译,不是口译。不同的专业人士,不同的认证,按字数定价。(如果文档是在一场实时会议中出现的,那是这两项工作交汇的唯一场合——见下文。)
AI 的定位:机器口译
AI 进入笔译和口译领域的步伐是不对称的。文本的机器翻译已有数十年的历史且无处不在。机器口译——实时语音输入、实时语音输出、双向、以对话语速进行——只有在语音识别、机器翻译和语音合成都变得足够快、能够以亚秒级延迟串联起来时,才变得切实可行。
我们构建了其中一套系统,因此这里为您提供的是该类别的真实面貌,而非推销辞令:
- AI 口译目前能做什么: 针对会议的连续同声传译,按听众分别提供,无需预订,无日费率。在 InterMIND 的案例中,这涵盖了 24 种语言的实时语音,通过零样本合成保留每位发言者的原声,而不是单一的合成旁白(工作原理)——外加人工口译员从未被要求涵盖的会议部分:聊天消息、共享笔记以及拖入通话中的文档,全部进行内联翻译。
- 对任何供应商(包括我们在内)应提出的要求: 公布每个语言对的质量,而不是语言数量。“支持 60 种语言”对于您的德英互译什么也没说。我们的质量是在 FLORES-200 上按月测量的,并在 /benchmark 上完整发布——或者运行实时演示,用您自己的耳朵来判断。
- AI 口译做不到的事: 在认证环境中取代经认证的口译员。法庭、条约谈判和宣誓程序属于人类的领域。AI 的领地是该标准之下广阔的空间——那些因为隔间和日薪定价过高而从未获得口译服务的会议。
主要的会议平台处于中间点:Zoom 和 Teams 为您自己寻找并支付费用的人工口译员提供口译频道,这三者都在符合条件的套餐上提供翻译字幕,而 Google Meet 在符合条件的套餐上提供Gemini 语音翻译。如果您是在比较工具而不是了解该类别,这份买家指南会附带来源进行比较:适用于会议和会议的最佳 AI 翻译工具。
常见问题
口译和笔译有什么区别? 口译是在交流发生时实时转换口语(或手语);笔译是在文本存在之后转换书面文本。口译员实时工作,没有修订环节;笔译员处理文档,有时间进行研究和修改。它们是独立的职业,拥有各自的认证。
口译的主要类型有哪些? 按模式分:同声传译(在发言者讲话时传达)、交替传译(在发言者的停顿中传达)、耳语传译/chuchotage(同声传译,向一两名听众低语)和联络传译(在小型交流中来回传达)。按交付形式分:现场、电话口译(OPI)、远程视频口译(VRI)、远程同声传译(RSI)和 AI 口译。
什么是同声传译? 与发言者并行传达的口译——听众听到的母语内容有几秒钟的延迟,会议绝不会为了翻译而暂停。这是联合国以六种语言举行会议的方式,也是多语言会议保持同一议程的方式。完整指南:同声传译详解。
口译员和笔译员一样吗? 不一样。口译员处理实时语音;笔译员处理书面文本。两者的技能几乎没有重叠——一种职业训练工作记忆和实时传达能力,另一种训练研究、写作和修改能力。确实存在两者都做的人,但每个角色的雇佣、认证和定价都是分开的。
口译和笔译哪个更难? 它们的难点不同。口译将所有内容压缩到实时进行——没有字典,没有第二稿,以发言者的语速传达语意,这就是为什么同声传译员会两人一组并大约每 30 分钟轮换一次。笔译则要求不同的严谨性:在被逐字审查、有时经过认证且具有法律约束力的文本上达到完全准确。
AI 能进行口译吗? 对于日常会议、网络研讨会和活动——可以:AI 系统现在可以为每位听众持续双向地口译实时语音。质量因供应商和语言对而异,因此请验证而不是假设:查看已发布的按语言对的基准测试(我们的在这里)或者用您自己的声音进行实时测试。对于认证环境——法庭、宣誓程序——经认证的人工口译员仍然是唯一符合资格的选择。
Zoom、Teams 或 Google Meet 包含口译功能吗? 部分包含。Zoom 和 Teams 为您自己雇用的人工口译员提供口译频道,这三个平台都在符合条件的套餐上提供翻译字幕;Meet 还在符合条件的套餐上提供 Gemini 语音翻译。它们都不是交钥匙的全场会议口译——各平台的详细分析在这里:Zoom、Teams、Meet。
亲耳感受区别,实时体验
定义解释了类别;而亲耳听到就能一锤定音。
- 运行实时演示 —— 说话,并在生产流水线上听到自己以原声被口译成另一种语言。
- 阅读基准测试 —— 每个语言对的质量,按月测量,完整发布。
- AI 同声传译详情 —— 实时口译如何在 InterMIND 会议中运作。
— Mind.com 团队
来源:ATA — Translator vs. Interpreter、United Nations DGACM — Interpretation、Chmiel — Boothmates forever? On teamwork in a simultaneous interpreting booth(每个隔间两名口译员,约 30 分钟轮换一次)、Zoom — Using language interpretation in meetings and webinars、Microsoft Teams — Use language interpretation in meetings、Google Meet — Speech Translation,于 2026 年 8 月查阅。供应商会随时间更改套餐和语言列表——请查看其页面以获取当前状态。