保留公式与版式的 PDF 论文翻译:pdf2zh 两条命令上手指南
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
PDFMathTranslate(命令行名为 pdf2zh)是一款开源的 PDF 全文翻译工具,能完整保留版面。它先用版面检测模型识别公式、图表和正文,只把文字送去翻译,最后同时输出纯中文译文和中英对照两个版本。它已被 EMNLP 2025 收录,两条命令即可跑起来。
普通翻译工具翻完论文后的通病
用普通工具翻一篇论文,你可能都见过这种场面:公式变成一串乱码、双栏被拆断、图编号和脚注错位,最后还得手动修排版。根源在于它只把文档看成一堆文字,并不理解版面的结构。
为什么公式翻完不会乱
pdf2zh 的做法是先"看懂页面"再翻译:
- 版面检测:内置 DocLayout-YOLO 模型逐块识别公式、图表、目录和标注,公式区域不送翻译,原样保留
- 双版本输出:一次翻译同时得到纯译文(
-mono.pdf)和中英对照(-dual.pdf),对照阅读两不误 - 服务随便换:默认 Google 无需任何密钥,也可用
-s切到 DeepL、OpenAI、Ollama 等 20 余种服务,本地模型同样能跑;--mcp还能以 MCP 服务器模式接入 Claude Desktop - 自带缓存:相同句子只调一次 API,重复处理同一份文档省时省额度
两条命令装好跑起来
要求只是 Python 3.11 到 3.12:
pip install pdf2zh pdf2zh document.pdf当前目录会生成document-mono.pdf和document-dual.pdf。不想敲命令的话,执行pdf2zh -i打开浏览器里的图形界面(默认 http://localhost:7860/),上传 PDF 直接翻。
批量翻译整个文件夹的方法
文献多的时候不用逐个喂。--dir会递归扫描目录下所有 PDF 并逐一翻译,-o指定结果落到哪:
pdf2zh --dir /path/to/papers/ -o results/其他常用参数:-p选页码范围、-li/-lo指定源语言和目标语言、-t调并发、--ignore-cache强制重新翻译。完整清单在官方文档 docs/ADVANCED.md 里都有表格可查。
📌 首次运行最容易踩的两个坑
- 扫描版 PDF 翻不了。它解析的是 PDF 里的文本层,纯图片扫描件请先行 OCR。
- 模型下载卡住。首次运行要拉取
wybxc/DocLayout-YOLO-DocStructBench-onnx模型,部分地区网络受限,按 README 提示设置镜像即可:
set HF_ENDPOINT=https://hf-mirror.comPowerShell 用户把这条换成$env:HF_ENDPOINT = "https://hf-mirror.com"。
一句话总结
pdf2zh 把"PDF 翻成中文且公式版面不坏"这件事压缩到了两条命令的距离。细节参数看 docs/ADVANCED.md,图形界面用法看 docs/README_GUI.md,装好翻一篇论文,就知道值不值。
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考