读英文论文最崩溃的时刻,往往不是看不懂句子,而是:
翻译完一打开——公式全乱、图表错位、目录飞了、注释也没了。
普通在线翻译或简单 OCR 工具对「带排版的科学 PDF」几乎束手无策。最近又刷到一个已经 3.6 万+ Star 的开源项目 PDFMathTranslate,专门解决这件事。
它到底解决了什么?
PDFMathTranslate 的核心能力是:
- 完整保留排版:公式、图表、目录、注释尽量原样保留
- AI 精准翻译:支持多种翻译引擎(Google、DeepL、Ollama、OpenAI 等)
- 双语对照:可生成纯译文 PDF 和双语对照 PDF
- 本地可跑:CLI、图形界面、Docker 都支持,数据不必上传第三方
项目还被选为 EMNLP 2025 Demo,定位就是「科学 PDF 文档翻译并保留格式」。
对做科研、写综述、跨语言读文献的人来说,这几乎是刚需。
怎么用?
最简单的几种方式:
- 命令行(有 Python 环境)
- 当前目录会生成译文和双语对照文件。
- 图形界面
安装后启动 WebUI,浏览器里拖文件、选语言、选引擎即可。 - Docker
适合不想折腾环境、想固定部署的人。 - 在线试用
官方提供了公共免费服务,以及和沉浸式翻译等平台的集成,想先体验再安装也很方便。
支持多语言互译,批量处理也相对省心。
适合谁?
- 经常需要读英文/多语种论文的研究生、科研人员
- 做文献综述、写中英双语材料的人
- 希望翻译后公式和图表还能正常看的人
- 在意隐私、想尽量本地处理文档的人
它不是「完美 100% 还原所有复杂排版」的魔法,但对大多数学术 PDF 已经比传统方案好非常多。复杂版式、扫描件、特殊字体仍可能有瑕疵,这是目前这类工具的共同边界。
小结
如果你还在用「整页截图 + 通用翻译」或者忍受公式乱成一锅粥的译文,PDFMathTranslate 值得认真试一次。
开源、免费、专注科学文档、排版尽量保留,已经把「能读」和「好看」这两个需求同时照顾到了。
GitHub:
https://github.com/PDFMathTranslate/PDFMathTranslate
先拿一篇自己常读的论文跑一遍,比空讨论开源翻译工具靠谱得多。




No comments yet