10分钟完成PDF翻译:用 PDFMathTranslate 把英文论文翻成中文,公式排版一个不错
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
你盯着屏幕上一篇双栏英文论文,截稿期在明早。逐句复制粘贴进翻译软件?公式散了,排版毁了。PDFMathTranslate 就是为这一刻准备的:一条pdf2zh命令,输出一份公式原样保留、排版分毫不差的中文 PDF。
要申请密钥吗
不用。默认走 Google 翻译后端,开箱即跑。只有换成 DeepL、OpenAI 这类服务时才需要填自己的密钥,而填密钥也只是加一个参数的事。
不想装 Python 的 Windows 用户,直接拿官方 release 包里的 exe,双击就能用。
两条命令装好,转出第一份中文 PDF
pip install pdf2zh需要 Python 3.11 或 3.12。装完后,终端里会多出一个pdf2zh命令。
pdf2zh your_paper.pdf跑完会在当前目录生成两个文件:your_paper-mono.pdf(纯中文版)和your_paper-dual.pdf(中英双语对照)。不知道先看哪个的话,先开 dual 版,原文和译文并排对着读。
200 页大论文怎么分段翻
别硬跑全文,用两个开关:
-p 1-30:只翻指定页。为什么加它:长文一次请求容易出错,分段跑随时可以从断点继续- 翻译缓存默认开启:翻过的段落自动缓存,重跑不重复消耗 API 额度
pdf2zh your_paper.pdf -p 1-30前 30 页跑完,接着用-p 31-60,依此类推。一次要处理好几篇论文的话,再加--dir批转整个目录,省得一篇篇敲命令。
公式为什么不会被翻坏
它不是"全文塞进翻译软件"。内置的版面识别模型(一个先区分正文、公式、图注、栏位的小模型)把版面拆开,逐段翻译,再把译文"画"回原文位置。常见数学字体默认受保护;想保护特定符号,用-f传一条自定义正则。
效果长这样——同一页 Nature 论文,翻译前后对照(DeepLX 后端):
标题、正文、图注全部变中文,公式和图的位置一个像素没动——这就是"保留排版"的实际含义。
离线模式怎么开
把-s参数指向 Ollama(本地部署大模型的运行器),就能用本地模型翻译,数据不出内网:
pdf2zh your_paper.pdf -s ollama首次运行卡在模型下载,多半是网络问题。先设镜像再重试:
set HF_ENDPOINT=https://hf-mirror.com以上是 Windows 写法,Linux 和 macOS 把set换成export即可。其他代理问题见 docs/PROXY_CONFIGURATION.md。
下一步
拿手边最近的一篇论文跑一遍pdf2zh your_paper.pdf。完整参数表在 docs/ADVANCED.md。
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考