news 2026/9/8 21:57:53

开源 PDF 论文翻译工具 pdf2zh:一条命令生成双语对照 PDF

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
开源 PDF 论文翻译工具 pdf2zh:一条命令生成双语对照 PDF

开源 PDF 论文翻译工具 pdf2zh:一条命令生成双语对照 PDF

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

读外文文献最费时间的不是读,是翻。开源 PDF 论文翻译工具 pdf2zh 先把页面切开、再逐段翻译,公式图表原位不动,一次跑出纯译文版和双语对照版两个 PDF。

📄 30 页英文论文,先别急着复制粘贴

开题要啃的综述、组里共享的英文报告,动辄三四十页。复制进翻译器,公式变乱码、双栏散架、页眉错位。pdf2zh 的做法不同:先用内置 DocLayout-YOLO ONNX 版面分析把页面切成正文、公式、图表、页眉等区域,只翻译文本区,译文再按原坐标回填,输出里公式图表的位置与样式都不变。

🚀 两行命令跑通全流程

Python 环境要求 3.11–3.12,装完直接翻:

pip install pdf2zh pdf2zh paper.pdf

跑完当前目录多出paper-mono.pdf(纯译文)和paper-dual.pdf(双语对照)。默认走 Google 服务,不用配任何密钥。注意:首次运行会下载版面检测模型,网络不畅时先设 HF 镜像(HF_ENDPOINT=https://hf-mirror.com)再跑,否则会卡在下载这一步。

按使用场景挑一条路

命令行玩家:常用参数一张表

参数作用
-p只译指定页码,如 1-3,5
-li/-lo源语言 / 目标语言
-s翻译服务,可写 服务:模型
-t翻译线程数
-o译文输出目录
-f/-c保留不译的字体或字符

一个组合示例,DeepL 翻译第 1–3 页、输出到 out 目录:

pdf2zh paper.pdf -li en -lo zh -s deepl -p 1-3,5 -o out

不想记参数:浏览器里点着玩

pdf2zh -i启动 Web 界面,浏览器访问http://localhost:7860/,拖文件进窗口、选服务和目标语言、点 Translate,完成后可直接预览、下载两个 PDF。给实验室同学共用时:--share生成一个对外临时链接;--authorized users.txt用"用户名,密码"清单限制登录人,还能自定义登录页。细节见 docs/README_GUI.md。

接进自己的系统:三种集成方式

  • Python:一行translate(files=['paper.pdf'], lang_in='en', lang_out='zh', service='google')调用,拿到 mono / dual 两个译文路径;
  • HTTP:装pdf2zh[backend]后跑 Flask + Celery,用 REST 提交任务、查进度、下结果,适合包成内部服务;
  • MCP:pdf2zh --mcp(可加--sse)把翻译挂给 Claude Desktop 等客户端,用自然语言让它找文件翻译。

进阶配置速查

  • 批量翻译文献pdf2zh --dir /path/to/papers/遍历目录里所有 PDF 逐个处理;
  • 配置文件--config config.json指定配置,缺省读~/.config/PDFMathTranslate/config.json,可预置语言、字体和多组服务密钥,命令行与环境变量仍可覆盖;
  • 自定义提示词--prompt prompt.txt控制发给大模型的指令,模板支持${lang_in}${lang_out}${text}三个变量,适合注入术语要求;
  • 缓存:同一段文本只翻一次,重复翻译不烧额度;想强制重翻加--ignore-cache
  • Docker 部署:团队共用一台翻译服务,两行拉起来,浏览器访问 7860 端口:
docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh
  • Windows 免安装版:发布页下载压缩包,解压双击pdf2zh.exe即用,打不开就补装 VC++ 运行库。

边界与踩坑

  • 扫描版 PDF 翻不了:工具读的是 PDF 内嵌文本,纯图片页面没有文本可翻,先做 OCR 再处理;
  • 质量取决于所选服务:默认 Google 免配置够日常用,术语要求高就换 DeepL 或大模型服务,再配--prompt注入领域要求;
  • 付费服务要配 API Key:DeepL、OpenAI、Gemini 等的环境变量对照表见 docs/ADVANCED.md;
  • Python 版本:本地运行需 3.11–3.12,不满足就改用 Docker 或 Windows 免安装版;
  • --mode precise是实验特性:v2 内核面向跨栏跨页一致性等边缘场景,需先搭独立环境,正式交付先用默认模式。

装完跑一次,几分钟拿到第一份双语论文。项目 AGPL-3.0 开源,参数细节见 docs/ADVANCED.md,集成开发见 docs/APIS.md。

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/8 21:57:33

AI Skill解析:从提示词到可复用技能包的工作原理

先说个我最近的经历。团队里有个老哥,跟我用同一个 AI 编程助手,做差不多的任务,但他的产出质量明显比我高一截。后来我翻了他的配置目录才明白,他把我们组里平时 code review、日志排查、测试用例设计的那套流程,全都…

作者头像 李华
网站建设 2026/9/8 21:54:03

ECG情绪识别技术原理与项目实战拆解

简介:本资源是一个基于心电信号(ECG)的情绪识别完整MATLAB实现项目,面向生物医学工程、人工智能与情感计算方向的本科生、研究生及算法工程师,解决从生理信号中自动判别情绪状态的技术落地问题,适用于心理健…

作者头像 李华
网站建设 2026/9/8 21:52:20

【信息科学与工程学】【解决方案体系】第三十九篇 上云解决方案系列 10 “莉莉丝游戏平台+支撑系统”上云01

“莉莉丝游戏平台+支撑系统”上云的总体解决方案蓝图(v1)。 参考基线:莉莉丝公开技术包含Unity深度定制渲染、动态LOD/GPU实例化、轻量神经网络移动端推理<10ms、Actor模型分布式分片、跨区域通信与压缩 ; 《剑与远征:启程》等采用云原生Kubernetes化 。底层网络参考r…

作者头像 李华
网站建设 2026/9/8 21:52:19

保留公式与版式的 PDF 论文翻译:pdf2zh 两条命令上手指南

保留公式与版式的 PDF 论文翻译:pdf2zh 两条命令上手指南 【免费下载链接】PDFMathTranslate [EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/Op…

作者头像 李华
网站建设 2026/9/8 21:49:18

cuDNN 8.6.0.163 Windows安装详解:版本匹配与环境变量排错指南

简介:面向Windows平台深度学习开发者的NVIDIA CuDNN 8.6.0.163(CUDA 11)库包,用于补齐GPU加速所需的核心组件,特别适合在TensorFlow、PyTorch等框架中遇到cuDNN缺失或版本不匹配问题的工程师。压缩包总计31个文件&…

作者头像 李华