指南
PDF 翻译「保留格式」到底是什么意思?7 项可以自查的标准
想找一个「翻译 PDF 不乱格式」的工具,你会发现每家都在承诺同一件事,措辞略有不同—— 但没有一家说清自己到底指什么。这不一定是不诚实,而是「格式」根本不是一句口号能承诺的 单一属性:它至少包含 7 个独立的方面,一个工具可以做好其中大多数,却恰恰在对你的文件 最关键的那一项上失手。下面是你自己动手、在任何工具上约 10 分钟就能测完的方法。
每个 PDF 翻译工具都承诺保留你的格式
看看各家工具在自己官网上是怎么描述这个功能的(原文照录):
| 工具 | 他们的原话 |
|---|---|
| DocTranslator | 「Keeps original formatting(保留原始格式)」 |
| Online Doc Translator | 「re-inserts translated text into its original position(把译文放回原位置)」 |
| DeepL | 「preserves formatting(保留格式)」 |
| Smallpdf | 「as much as possible(尽可能保留)」 |
| iLovePDF | 「as close as possible to the original(尽量接近原件)」 |
引文均为各工具自己的公开描述,已链接到出处。我们并不是在给这些工具打分——我们没有对它们 做过对照测试,一句宣传语也不构成任何方向的证据。我们能说的只是:这些措辞都没有告诉你, 它们指的是下面 7 项中的哪几项。
有两家在自己的文档里写得更具体,值得直接引用:Smallpdf 自己的博客提到 「图片和特殊排版目前不会带入」 翻译后的文件;iLovePDF 的帮助内容提到,原字体不可用时 可能使用视觉上相似的替代字体。这正是这篇指南想要的那种具体、可验证的表述——更多工具应该这样写。
「格式」不是一件事——至少是 7 件
这是我们自己内部使用的拆解。每一项都可以在几分钟内、在任何工具、用你自己的文件独立验证。
页面尺寸
检查:A4 翻译后还是 A4 吗?Letter 还是 Letter 吗?
页面被悄悄改了尺寸的译文,本身就已经是另一份文件了——仅这一条就可能让递交材料在被阅读之前先被退回。
页数
检查:翻译后总页数变了吗?
中译英的文字量通常膨胀 30–50%。工具不做处理的话,内容会溢出到新的页面,页码引用、页眉页脚、以及一切假定页数固定的东西都会被打乱。
表格
检查:列宽、边框,以及最关键的——数字对齐,都保住了吗?
搜「PDF 表格翻译不乱」的人多半是被真实问题逼来的:一张乍看没问题、但某个数字挪了一列的表,比明显坏掉的表更危险,因为它很难被发现。
看这一项在真实文件上的实测 →字体
检查:字号、加粗/斜体、颜色、行距是否接近原件——还是被换成了别的字体?
有些工具在缺少原字体时,会替换一个看起来相似的字体。屏幕上可能看不出来,但打印效果和换行位置可能完全不同。
图片、印章、签名
检查:原始图形层是被原样保留——还是被重新生成了?
被重绘的签名、被改动的印章不是外观小瑕疵。工具只要碰了这些元素,就应当被当作警告信号,而不是功能亮点。
看这一项在真实文件上的实测 →文字可选中、可复制
检查:翻译后的文字能用鼠标选中吗?能搜索、能复制出来吗?
有些工具返回的其实是一张「印着译文的图片」盖在原页面上。它看起来和真正的翻译一模一样,但这一项测试会完全不及格。
扫描件
检查:对扫描件或照片,工具是重建了真实文字层,还是只生成了一张「看起来翻译过了」的图?
这是最难的情况,也是大多数工具轻轻带过的地方:没有文字可以原位编辑,输出只能是尽力而为的重建,不是编辑。风险等级完全不同。
看这一项在真实文件上的实测 →自己动手测任何一个 PDF 翻译工具
你不需要相信我们——或任何人——的说法。挑一份真实文件(最好带表格), 用你正在评估的工具翻译一遍,然后按这个清单逐项核对:
- 把原件和译文并排打开。
- 核对页面尺寸和总页数是否一致(不一致就记下差在哪)。
- 挑一行带数字的表格,确认数字本身、所在列、对齐方式完全相同。
- 用鼠标试着选中一句译文。
- 找一个图形元素——logo、印章、签名或照片——确认它逐像素未被改动。
- 如果原件是扫描件或照片,在该文件上把文字选中测试再做一遍。
十分钟,你对这个工具在你的文件上的真实表现,就会比任何营销页面告诉你的都多。
所以,保留排版最好的 PDF 翻译工具是哪个?
诚实的回答:取决于上面 7 项中哪一项对你的文件最重要。我们宁愿教你怎么验证, 也不想给出一个我们没做过测试、无法负责的排名。关于我们自己的做法,能明确说的是:
- 对原生 PDF(有真实文字层的),KeepFormat 直接在原文字层上原位替换—— 页面尺寸不变、页数不变、表格网格不变、字体不变、输出文字完全可选中——因为没有任何东西 被重新生成,只有文字被替换。
- 对扫描件和照片,没有文字层可编辑,任何工具(包括我们)都只能重建页面。 我们把重建的真实效果——成功和失败都在内——完整发布在 扫描版银行流水翻译实测指南 里,包括一个密集表格大面积未被翻译的失败案例。
我们建议用同样的模型去审视你考虑的任何工具:问它对原生文件和扫描件分别怎么处理, 并且要求看到实例,而不是听描述。
| 属性 | 模糊的承诺听起来像 | 实际应该验证什么 |
|---|---|---|
| 页面尺寸 | 「保留格式」 | A4 翻译后还是 A4 吗?Letter 还是 Letter 吗? |
| 页数 | 「保留格式」 | 翻译后总页数变了吗? |
| 表格 | 「保留格式」 | 列宽、边框,以及最关键的——数字对齐,都保住了吗? |
| 字体 | 「保留格式」 | 字号、加粗/斜体、颜色、行距是否接近原件——还是被换成了别的字体? |
| 图片、印章、签名 | 「保留格式」 | 原始图形层是被原样保留——还是被重新生成了? |
| 文字可选中、可复制 | 「保留格式」 | 翻译后的文字能用鼠标选中吗?能搜索、能复制出来吗? |
| 扫描件 | 「保留格式」 | 对扫描件或照片,工具是重建了真实文字层,还是只生成了一张「看起来翻译过了」的图? |
常见问题
为什么不同工具说的「保留格式」含义不一样?
因为「格式」实际上打包了多个彼此独立的属性——页面尺寸、页数、表格结构、字体、图片、文字是否可选中、扫描件如何处理。一个工具可能其中几项做得很好、另几项很弱,而一句营销口号不会告诉你是哪几项。
怎么判断翻译后的 PDF 文字是真文字还是图片?
打开文件,用鼠标试着选中一个词,或者按 Cmd/Ctrl+F 搜索页面上能看到的一个词。能正常选中和搜索,就是真文字。毫无反应的话,你看到的只是一张文字图片——不能复制、不能搜索、读屏软件也读不了。
PDF 翻译后页数会变吗?
有可能,尤其是从中文这类信息密度高的语言翻成英文时,文字量常膨胀 30–50%。内容会不会被挤到新的一页,取决于工具是选择缩小字号来适配,还是严格保持原字号。
扫描件翻译出来的是图片还是真文字?
完全取决于工具,值得直接验证——用上面说的方法试着选中译文。很多在视觉上处理得不错的工具,底下返回的仍是一张压平的图片,没有任何文字层。
