10分钟完成PDF翻译:用 PDFMathTranslate 把英文论文翻成中文,公式排版一个不错
2026/9/10 22:17:34 网站建设 项目流程

10分钟完成PDF翻译:用 PDFMathTranslate 把英文论文翻成中文,公式排版一个不错

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

你盯着屏幕上一篇双栏英文论文,截稿期在明早。逐句复制粘贴进翻译软件?公式散了,排版毁了。PDFMathTranslate 就是为这一刻准备的:一条pdf2zh命令,输出一份公式原样保留、排版分毫不差的中文 PDF。

要申请密钥吗

不用。默认走 Google 翻译后端,开箱即跑。只有换成 DeepL、OpenAI 这类服务时才需要填自己的密钥,而填密钥也只是加一个参数的事。

不想装 Python 的 Windows 用户,直接拿官方 release 包里的 exe,双击就能用。

两条命令装好,转出第一份中文 PDF

pip install pdf2zh

需要 Python 3.11 或 3.12。装完后,终端里会多出一个pdf2zh命令。

pdf2zh your_paper.pdf

跑完会在当前目录生成两个文件:your_paper-mono.pdf(纯中文版)和your_paper-dual.pdf(中英双语对照)。不知道先看哪个的话,先开 dual 版,原文和译文并排对着读。

200 页大论文怎么分段翻

别硬跑全文,用两个开关:

  • -p 1-30:只翻指定页。为什么加它:长文一次请求容易出错,分段跑随时可以从断点继续
  • 翻译缓存默认开启:翻过的段落自动缓存,重跑不重复消耗 API 额度
pdf2zh your_paper.pdf -p 1-30

前 30 页跑完,接着用-p 31-60,依此类推。一次要处理好几篇论文的话,再加--dir批转整个目录,省得一篇篇敲命令。

公式为什么不会被翻坏

它不是"全文塞进翻译软件"。内置的版面识别模型(一个先区分正文、公式、图注、栏位的小模型)把版面拆开,逐段翻译,再把译文"画"回原文位置。常见数学字体默认受保护;想保护特定符号,用-f传一条自定义正则。

效果长这样——同一页 Nature 论文,翻译前后对照(DeepLX 后端):

标题、正文、图注全部变中文,公式和图的位置一个像素没动——这就是"保留排版"的实际含义。

离线模式怎么开

-s参数指向 Ollama(本地部署大模型的运行器),就能用本地模型翻译,数据不出内网:

pdf2zh your_paper.pdf -s ollama

首次运行卡在模型下载,多半是网络问题。先设镜像再重试:

set HF_ENDPOINT=https://hf-mirror.com

以上是 Windows 写法,Linux 和 macOS 把set换成export即可。其他代理问题见 docs/PROXY_CONFIGURATION.md。

下一步

拿手边最近的一篇论文跑一遍pdf2zh your_paper.pdf。完整参数表在 docs/ADVANCED.md。

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询