
别再无脑把 PDF 丢进 Google 翻译了
PDF 翻译后格式全乱怎么办?我太懂这个问题了,之前也被这事折磨过。
读外文文献的时候,遇到一篇特别重要的论文,用 Google 翻译整个 PDF 传上去,结果下载下来一看,表格跑到页面外面去了,公式变成乱码,参考文献全挤成一坨。本来想省时间,结果光修格式就花了我一个多小时,还不如直接复制粘贴到翻译工具里一段段看。
后来我试过几种办法,说一下踩坑经验吧。
最土但最靠谱的办法,其实是别翻译整个 PDF。如果你的文档不长,直接复制文本段落丢进 DeepL 或者 Google 翻译,虽然麻烦一点,但至少不会出格式灾难。DeepL 的翻译质量确实好,尤其英德、英法这种语言对,句子读起来顺很多。不过它免费版有字数限制,长文献得分段处理,有点烦。
如果你一定要整篇翻译——比如几十页的报告、合同这种——那工具的选择就很关键了。我最近在用 https://pdftranslator.org/ 这个,说实话第一次用的时候没抱太大期望,因为之前被坑过太多次。但它翻译完的 PDF 确实保留了原来的排版,表格该在哪还是在哪,图片位置也没乱跑。不用注册,传上去等几分钟就能下载。免费额度每月 1000 页,对学生来说基本够用。(附上我最近翻译的王虹获奖论文)

有一点要提醒,如果你的 PDF 是扫描件(就是那种图片格式的,不是可选文字的),很多工具会直接翻译不出来。上面说的那个工具带 OCR 能力,可以处理扫描件,但识别精度取决于原文清晰度,别指望它对模糊扫描件也百分百准确。
另外还有一个思路,就是干脆把 PDF 转成 Word 再翻译。PDF 转 Word 用 Adobe Acrobat 或者在线的 Smallpdf 都行,转完之后在 Word 里直接翻译,格式调整也方便。但这个方案的问题在于,PDF 转 Word 本身就可能出现格式错乱,尤其是有复杂排版的文档。所以本质上只是把问题提前了一步。
总结一下:短文档就复制粘贴到 DeepL,长文档需要保格式就用 PDF 翻译工具,扫描件注意确认有没有 OCR。没有完美的方案,选哪个看你文档的具体情况。