news 2026/9/2 19:08:05

PDF翻译公式不丢:5分钟装好,一份论文出双语

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
PDF翻译公式不丢:5分钟装好,一份论文出双语

PDF翻译公式不丢:5分钟装好,一份论文出双语

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

翻完的文档里,公式还在、图表还在、目录还在,只省下了你逐句查词典的时间。PDFMathTranslate(命令名 pdf2zh)是一个开源的 PDF 翻译工具,把论文做全文双语翻译,同时保持原版式不动。

它是什么给谁用解决什么
AI 驱动的 PDF 全文双语翻译工具读外文论文、技术文档的人翻译后公式变乱码、排版错位

60秒装好:两条命令出第一份双语PDF

pip install pdf2zh pdf2zh paper.pdf

装完把任意 PDF 丢进去,当前目录会生成纯译文和中英对照两个文件。不碰终端可以跑pdf2zh -i在浏览器里拖拽操作;服务器环境用 Docker 镜像byaidu/pdf2zh一行拉起。

最常碰到的4个能力:公式、版式、服务、拖拽界面

📐数学公式保留—— 行内公式和独立公式块都被识别后原样输出,不参与翻译。翻一篇 40 页的机器学习论文,不用回头核对第 12 页的推导步骤。

🗂️版式与目录保留—— 图表、表格、目录都留在原位置。翻译版翻页时,原文的页码引用依然对得上。

🌐翻译服务可换—— Google、DeepL、OpenAI、Ollama 本地模型等,-s参数一键切换。术语讲究就换贴合学科的服务,断网场景用本地模型照样跑。

🪟浏览器图形界面—— 一条命令打开拖拽界面,PDF 拖进去、选目标语言、点翻译即可。不写命令行的人走这条路最顺。

用得最多的3类人

如果你是每周读 3-4 篇英文论文的研究生,可以用它快速生成中文对照版,公式不再需要二次核对。 如果你是手里总压着一批英文技术文档的工程师,可以把它当成整批文档的转换器,一条命令跑完。 如果你是准备双语教学材料的老师,可以用它生成中英对照讲义,两边公式和插图完全一致。

进阶两招:精准解析与整文件夹批量翻译

第一招:精准布局解析

pdf2zh --mode precise paper.pdf

公式密集的文档换用实验性 v2 内核,布局解析更细。代价是它仍在实验阶段,重要产出建议先小批量验证。

第二招:整个文件夹一次翻完

pdf2zh --dir /path/to/papers/

把目录交给它逐个处理,整理整份阅读清单就靠这句。其余能力也不弱:-p 1-5只翻指定页码、-s deepl换服务、--prompt自定义提示词,完整清单见高级参数文档。

公式不坏,它靠什么做到

先用 DocLayout-YOLO 模型把 PDF 切成文本、公式、图表等区块,只有文本区块送进翻译服务,其余元素原样贴回页面——"翻译但不破坏格式"就这一个原理。

3个高频疑问

问:翻译后公式会变形吗?答:不会。公式被识别为独立区块、不参与翻译,输出和原文一致。

问:支持哪些语言?答:中、英、日、韩、法、德等语言可互译,用-li/-lo分别指定源语言和目标语言。

问:必须联网吗?答:用 Google、DeepL 等在线服务需要网络;换 Ollama 本地模型即可离线完成全部流程。

3条实用建议

  • 学术文档先用-s切换 2-3 个服务试翻几页,选术语最稳的那个。
  • 大文档用-t开多线程,等待时间明显缩短。
  • 翻译结果带缓存,重复翻同一份秒出;想强制重译加--ignore-cache

现在就试:克隆、安装、翻译

源码全开放,可以直接上手体验完整流程。

git clone https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

界面相关的细节在图形界面使用说明里都有。

核心关键词:PDF翻译,公式保留,双语对照,学术文档翻译

长尾关键词:PDF数学公式翻译工具,学术论文中文翻译,保留排版的PDF翻译,批量PDF翻译,离线本地模型翻译

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/1 10:47:01

轻量级Agent OS实战:用Python实现任务调度与工具管理

最近一段时间,“Agent OS”这个关键词频繁出现在 AI 技术社区和各大厂商的发布会里。很多刚接触 LLM 应用开发的读者可能会疑惑:它和 LangChain、AutoGen 这些 Agent 框架有什么区别?它到底是一个操作系统,还是一种新框架&#xf…

作者头像 李华
网站建设 2026/9/1 10:43:02

AI原生SDLC落地:代码变快后,工程师如何重做流程

如果你最近在用 AI 辅助写代码,大概率会发现一个现象:单点编码速度确实上来了,但整个软件交付链路并没有同比例变快。需求讨论、架构设计、代码评审、测试验收、发布运维,每一个环节都开始出现“代码等流程”的卡顿。项目标题里有…

作者头像 李华
网站建设 2026/9/1 10:40:34

Grok Bot 11个实用用例:从编码调试到文档撰写的AI工作流

如果你也在尝试把 AI 塞进日常开发工作流,大概率已经用过各种聊天助手写代码、查报错、整理文档。但很多人用了一段时间后发现,效率提升并不明显,原因往往不是工具不够强,而是提问方式太随意、任务拆得太粗。本文围绕 Grok Bot 的…

作者头像 李华