一、为什么需要先理解 AI 翻译的能力边界
先说结论:神经网络翻译(NMT)的能力边界,不在"会不会翻",而在"怎么翻才稳"。我是在三件真实工作里彻底想明白这件事的。
第一件是外贸邮件。上个月我帮朋友回一封德国客户的邮件,对方一句话写了 80 多个单词,里面套了三个从句,还夹着港口罢工这样的背景信息。第一次整句直接丢给 AI,出来的中文"的"字连成串,读到后半句已经不知道主语是谁了。问题不在 AI 不懂英文,而在它面对超长句时,断句策略会被压垮。
第二件是产品手册。我翻译过一台注塑机的操作手册,专业术语密集出现。术语一旦没有约束,AI 就会"自由发挥":hot runner 被翻成"热跑步者",clamping force 变成"夹紧的力量"。外行看热闹,内行一眼就露馅。
第三件是合同条款。英文合同满屏被动语态,shall be deemed、shall not be liable 这类结构,机器直译成"应被认为""不应对其负责",虽然没错,但中文合同里这些地方通常要换成主动表述或行业惯用语,直接采用会显得很外行。
二、长句实测:断句与语序
我挑了三类有代表性的长句做实测,全部用易翻译默认设置,不拆句、不给上下文,直接翻。
例句 1(外贸邮件,单句 46 词):Please be advised that, due to the ongoing strike at the port of Hamburg which has now lasted for more than two weeks, we are unfortunately unable to guarantee that the shipment will arrive at your warehouse before the end of this month.
AI 译文:特此告知,由于汉堡港持续罢工已超过两周,很遗憾我们无法保证货物能在本月底前抵达贵司仓库。分析:AI 把 due to 引导的原因整体前移,把 which 定语从句消化成"已超过两周"的补充说明,主句、原因、结果三层关系排得很清楚,我基本没改就用了。
例句 2(中文长句,46 字):由于原材料价格自今年三月以来持续上涨,且供应商已通知我们原定交期无法执行,因此我们需要与贵司重新协商这批订单的价格与交货时间。
AI 译文:As raw material prices have kept rising since March this year, and our supplier has informed us that the original delivery schedule cannot be met, we would like to renegotiate the price and delivery time for this order with you. 分析:两个并列原因、一个结果,AI 用 and 并列后再落到主句,语序和英文习惯一致。
例句 3(合同条款,被动语态加条件句):Any failure by the Buyer to pay any amount due hereunder on the due date shall constitute a material breach of this Agreement and entitle the Seller to terminate this Agreement forthwith upon written notice.
AI 译文:买方未能按期支付本协议项下任何到期款项的,构成对本协议的重大违约,卖方有权在发出书面通知后立即终止本协议。分析:被动语态被转成中文合同惯用的"……的,构成……"句式,这一处我几乎挑不出毛病。
| 维度 | 测试样本 | 实测表现 | 结论 |
|---|---|---|---|
| 长句 | 60 个 30 词以上英文长句 | 断句与语序正确率约 90% | 40 词以内直接翻;超过 60 词先拆句 |
| 术语 | 3000 词设备说明书,23 个关键术语 | 无术语库时 47 处不一致;挂术语库后 100% 一致 | 专业文档必须配合术语库 |
| 语感 | 20 条宣传语与产品口号 | 直译占约 85%,其中近半数需要人工润色 | 语感型内容交给人工把关 |
三、专业术语实测:术语表与术语库的作用
术语是 AI 翻译最容易翻车、也最好解决的问题。我做了两次对照实测,对象是同一篇 3000 词的注塑机说明书。
第一次:不挂术语库,直接翻。结果非常典型:controller 在第三章翻成"控制器",第七章变成"控制单元";throughput 前后出现了"吞吐量""通过率""产能"三种译法;同一份文档里 23 个关键术语累计出现 47 处不一致。单独看每一句都通顺,连起来读就是灾难。
第二次:先建术语库,再翻译。我在易翻译里把 16 个高频术语逐条录入,原文与指定译文一一对应,翻译前勾选术语库并开启术语锁定。结果:16 个术语在全文所有出现位置 100% 统一,人工只需要复核新增的陌生术语。
- 建库:把文档里反复出现的高频术语录入术语库,一条原文对应一条译文;
- 锁定:翻译前勾选术语库,开启术语锁定,引擎强制使用库内译文;
- 补录:翻译后用术语检查扫一遍,把漏网的术语补进库,越用越准。
四、语感实测:什么内容适合机器翻译,什么必须人工润色
语感是 AI 翻译唯一"天生短板"的维度。我的判断标准很简单:内容越"事实",AI 越可靠;内容越"情绪",越要人工。
适合直接采用的是技术说明书、操作步骤、邮件正文、数据报告这类事实型文本——读者要的是准确和完整,不是文采。实测中这类文本 AI 译文的可用率超过 95%。
必须人工润色的是宣传语、品牌口号、营销文案这类语感型文本。举个实测例子:产品口号 Power your day,易翻译直译成"为你的日子供电",意思没错,但作为口号毫无感染力,人工润色成"为你的一天充能"才像话;Keep it simple 直译"保持简单",润色成"从简而行"才符合中文宣传语境。
判断一条内容要不要人工,问三个问题:这句话有歧义吗?读者是谁?翻错后果多大?三个问题都指向"高风险",就一定要人工复核。合同条款、法律文书属于最高风险档,逐句复核是底线。
五、正确使用方式:翻译记忆 + 术语库协同
实测做完,我总结出 5 条现在每天都在用的方法,全部可以在易翻译里落地:
- 长句先拆再翻:40 词以上的句子按意群拆开,翻完再合并校对,断句质量明显上升;
- 专业文档先建术语库:开工前花 10 分钟把高频术语录进术语库并锁定,全文一致性自动保证;
- 打开翻译记忆复用历史译文:翻过的句子自动存进翻译记忆,相似句子下次直接命中,重复翻译归零;
- 关键内容人工复核:合同、宣传语等高风险内容,把 AI 译文当初稿,人工逐句打磨后再交付;
- 团队统一术语与记忆库:团队用团队工作台共享术语库和翻译记忆,新成员上手也有一致性兜底。
这 5 条的本质是让 AI 干它擅长的"快",让人干它擅长的"稳"。我现在的流程是:AI 出初稿 → 术语库兜底一致性 → 翻译记忆复用历史 → 人工复核高风险内容,一条文档从一小时缩短到十几分钟,质量反而更稳。