本人平时需要经常阅读英文论文、技术文档,最麻烦的往往不是英文,而是这些 PDF 翻译后的效果太差,比如复制出来的文字排版混乱,表格、公式和图片错位等,翻译完成后几乎没法正常阅读。
今天推荐一个开源项目 BabelDOC,它做的事情很简单,却非常实用——利用 AI 翻译 PDF,并尽可能保留原文的排版结构。
BabelDOC 并不是简单地把 PDF 中的文字提取出来翻译,而是会分析 PDF 的文本、图片、表格、公式以及页面布局,再调用大语言模型进行翻译,最后重新生成 PDF。这样一来,翻译后的文档依然能够保持原来的阅读体验。
更实用的是,它支持生成纯译文 PDF 和双语对照 PDF。对于经常阅读国外论文、技术资料、产品文档的朋友来说,可以直接把一份几十页甚至上百页的英文 PDF 交给 AI 处理,省去大量复制、粘贴和手动排版的时间。
项目支持 OpenAI 等大模型作为翻译引擎,同时提供命令行和 Python 接口。如果你经常下载 GitHub、arXiv 或国外技术网站上的英文资料,这个工具非常值得收藏。
项目地址: