PDFMathTranslate:36k Star 开源神器,翻译科研 PDF 公式图表不乱

普通 PDF 翻译常把公式、图表、目录搞得面目全非。PDFMathTranslate 专为科学文献设计,用 AI 做全文翻译的同时完整保留排版,支持双语对照。提供 CLI、GUI、Docker 多种方式,兼容 Google、DeepL、Ollama、OpenAI 等引擎,本地可跑、隐私友好。适合科研党、论文阅读者和需要批量处理 PDF 的人。

读英文论文最崩溃的时刻,往往不是看不懂句子,而是:

翻译完一打开——公式全乱、图表错位、目录飞了、注释也没了。

普通在线翻译或简单 OCR 工具对「带排版的科学 PDF」几乎束手无策。最近又刷到一个已经 3.6 万+ Star 的开源项目 PDFMathTranslate,专门解决这件事。

它到底解决了什么?

PDFMathTranslate 的核心能力是:

  • 完整保留排版:公式、图表、目录、注释尽量原样保留
  • AI 精准翻译:支持多种翻译引擎(Google、DeepL、Ollama、OpenAI 等)
  • 双语对照:可生成纯译文 PDF 和双语对照 PDF
  • 本地可跑:CLI、图形界面、Docker 都支持,数据不必上传第三方

项目还被选为 EMNLP 2025 Demo,定位就是「科学 PDF 文档翻译并保留格式」。

对做科研、写综述、跨语言读文献的人来说,这几乎是刚需。

怎么用?

最简单的几种方式:

  1. 命令行(有 Python 环境)
  2. 当前目录会生成译文和双语对照文件。
  3. 图形界面
    安装后启动 WebUI,浏览器里拖文件、选语言、选引擎即可。
  4. Docker
    适合不想折腾环境、想固定部署的人。
  5. 在线试用
    官方提供了公共免费服务,以及和沉浸式翻译等平台的集成,想先体验再安装也很方便。

支持多语言互译,批量处理也相对省心。

适合谁?

  • 经常需要读英文/多语种论文的研究生、科研人员
  • 做文献综述、写中英双语材料的人
  • 希望翻译后公式和图表还能正常看的人
  • 在意隐私、想尽量本地处理文档的人

它不是「完美 100% 还原所有复杂排版」的魔法,但对大多数学术 PDF 已经比传统方案好非常多。复杂版式、扫描件、特殊字体仍可能有瑕疵,这是目前这类工具的共同边界。

小结

如果你还在用「整页截图 + 通用翻译」或者忍受公式乱成一锅粥的译文,PDFMathTranslate 值得认真试一次。

开源、免费、专注科学文档、排版尽量保留,已经把「能读」和「好看」这两个需求同时照顾到了。
GitHub:
https://github.com/PDFMathTranslate/PDFMathTranslate

先拿一篇自己常读的论文跑一遍,比空讨论开源翻译工具靠谱得多。

No comments yet