PDF 论文翻译如何完整又快,公式排版还能留住?
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
PDFMathTranslate(命令pdf2zh)是一个 PDF 论文翻译工具:只翻译文字层,公式、图表、目录和双栏版式都不动,适合要啃外文文献的学生和科研人员。
读外文文献的痛点:复制粘贴翻译为什么会毁掉版式
遇到一篇外文论文,很多人第一反应是把文字复制出来丢给翻译网站。网页文章这么干没问题,论文却基本会翻车:公式变成乱码符号,双栏被贴成错乱的一长条,图注和脚注跑到不相干的位置。所以 PDF 论文翻译要做的,不只是把字换成中文,版式也得跟着保住。PDFMathTranslate 正是为此设计的开源工具:只有文本层参与翻译,其余元素全部跳过。
pdf2zh 安装命令:从 pip 到第一次翻译
把版本和网络确认好,安装就是最省心的部分。下面四个前提,缺一个首跑就会卡住:
- Python 版本要在 3.11 到 3.12 之间(
pyproject.toml声明>=3.11,<3.13,3.10、3.13 都不行) - 网络要通:首次运行会从 Hugging Face 拉取 ONNX 版面模型
wybxc/DocLayout-YOLO-DocStructBench-onnx,断网会一直卡在下载 - 依赖不用手动装,
pip install时 onnxruntime、pdfminer、gradio 等会自动带入 - Windows 上跑 exe 版本若报 DLL 加载失败,先安装 VC++ 2015–2022 运行库
操作本身只有两步:
pip install pdf2zh pdf2zh document.pdf翻译服务默认是 Google,不配密钥也能跑。执行结束后,当前目录会多出两份产物:document-mono.pdf是纯译文版,document-dual.pdf是中英对照版。首轮执行会在模型下载上多花点时间,属于正常现象。
翻完的 PDF 长什么样:公式与双栏版式为什么还在
官方演示挑的是一篇 Nature 论文,中文版效果如下:中英同页对照,双栏位置一致,图编号、脚注、页眉各在其位,数学符号完整没散架。
原理并不复杂:DocLayout-YOLO 的 ONNX 模型先逐页检测公式、图片、表格、目录等元素,只有文字块会被送去翻译服务,其余一律跳过;译文再按原字体、原位置回填。整条管线分版面解析、逐块翻译、最后合成三步,所以版式漂移很少。想看实现细节,可以翻源码 pdf2zh/doclayout.py。
单个、批量、GUI、容器、MCP:五种入口怎么选?
只翻一篇论文:pdf2zh paper.pdf,结果直接落在当前目录。
要一次翻完整个文件夹:pdf2zh --dir /path/to/papers/ -o results/,目录里的 PDF 批量处理,产物统一进-o指定的目录。
更喜欢用鼠标:pdf2zh -i启动后打开http://localhost:7860/,在浏览器里配置服务、挑页码、实时预览。
不想在本机装 Python 环境:🐳 执行docker pull byaidu/pdf2zh再docker run -d -p 7860:7860 byaidu/pdf2zh,同样是 7860 端口的 Web 界面。
希望在 AI 对话里直接翻 PDF:pdf2zh --mcp注册进 Claude Desktop,配置示例见官方进阶文档。
pdf2zh 常用参数:日常 8 个选项
下表按用途排列,覆盖日常大多数情况:
| 参数 | 作用 | 示例 |
|---|---|---|
-p | 只翻译指定页码 | pdf2zh paper.pdf -p 1-3,5 |
-s | 切换翻译服务 | -s deepl、-s openai:gpt-4o-mini |
-li/-lo | 源语言 / 目标语言 | -li en -lo zh |
-t | 翻译线程数,并发处理 | -t 4 |
-o | 输出目录,缺省为当前目录 | -o results/ |
--ignore-cache | 忽略翻译缓存,强制重新翻译 | --ignore-cache |
--prompt | 加载自定义 LLM 提示词文件 | --prompt my.txt |
--config | 加载 JSON 配置文件 | --config c.json |
高频问题修复:扫描版、模型下载、鉴权报错
扫描版 PDF 翻不动:文件是纯图片扫描件,没有文本层,而 pdf2zh 解析的就是文本层,自然取不到内容。先用 OCR 生成文本层,再投入翻译。
模型下载卡住:首次运行要拉wybxc/DocLayout-YOLO-DocStructBench-onnx,部分地区访问 Hugging Face 受限。运行前设置镜像即可:
set HF_ENDPOINT=https://hf-mirror.comPowerShell 用户写成$env:HF_ENDPOINT = https://hf-mirror.com。
切换服务后报鉴权错误:多半是对应环境变量没提前设置,比如DEEPL_AUTH_KEY、OPENAI_API_KEY。各服务对应哪些变量名,官方进阶文档里的表格查得到,设完再执行。
适合谁,不适合谁
想要"PDF 翻成中文、版式还在",装好 pdf2zh 就能快速交付第一批论文。但它不是万能的:纯扫描文档(OCR 路径目前还是实验功能,效果因文件而异)、希望嵌入闭源商业产品的用户(仓库采用 AGPL-3.0 许可,先看清条款)、以及追求逐字逐句绝对精确的场合,都不建议直接上手,先对照官方进阶文档确认适用性。
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考