PDF 论文翻译不毁排版:PDFMathTranslate 本地实操笔记
2026/9/20 21:10:53 网站建设 项目流程

PDF 论文翻译不毁排版:PDFMathTranslate 本地实操笔记

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

PDFMathTranslate(pip 包名 pdf2zh)是一个用 AI 做 PDF 全文翻译的工具。 英文论文翻成中文后,公式、图表、目录都留在原处。 学生刷文献、科研人员精读原文、想搭共享服务的团队,都会用到它。

对号入座:你是哪种用法

  • 只翻一篇:走命令行,一条命令出结果;
  • 一次翻一批文献:命令行加--dir指向整个目录;
  • 给团队共用:上 Docker,成员浏览器访问即可,机器上什么都不用装。

装之前花两分钟检查

本地安装只要求一条:Python 版本在 3.11–3.12 之间。 先确认一下:

python --version # 确认版本在 3.11 到 3.12 之间

版本没问题就装包:

pip install pdf2zh

装完输入pdf2zh --help能看到参数列表,就算装好了。

挑一条路径跑起来

命令行直接翻译

# 默认用 Google 服务,译文输出到当前目录 pdf2zh your_document.pdf

跑完后当前目录多出译文 PDF,打开翻两页确认公式没跑位,就算成功。 只翻前几页就加-p 1-5,换引擎加-s deepl,细节见 docs/ADVANCED.md。

图形界面启动步骤

pdf2zh -i

这条命令会起一个本地 Web 服务,自动打开浏览器。 没自动打开就手动访问http://localhost:7860,拖入 PDF、选服务、等它跑完。

Docker 部署团队共用服务

docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh

两条命令跑完,在浏览器访问http://服务器IP:7860。 能打开上传页面,就说明部署成功了。

翻译引擎怎么选 🔍

左边是原文,右边是 DeepL 翻译后的版本,公式和排版原封不动:

翻译引擎分三档,按你的处境挑:

  • 免费日常档:Google(默认)或 DeepL 免费档,日常读文献够用;
  • 质量优先档:DeepL Pro 或 OpenAI 接口,适合正式出版前的精翻,需要先在环境变量里配置对应的 API key;
  • 全本地档:Ollama 或 Xinference 跑开源模型,数据和算力都留在自己机器上,只把模型名和地址写进环境变量就行。

翻得不对先查这四处 🩹

现象:首次运行提示模型下载失败首次运行要拉取一个版式识别模型,换镜像源重试:

export HF_ENDPOINT=https://hf-mirror.com # Windows 用 $env:HF_ENDPOINT 写法

现象:复杂排版的 PDF 翻不动或报错

pdf2zh complex_document.pdf --compatible

现象:大文件翻译太慢

pdf2zh large_document.pdf -t 4 # 开 4 个翻译线程

现象:GUI 起不来,提示端口被占用

pdf2zh -i --serverport 8000 # 默认 7860,换一个端口

常用参数速查:

参数作用
-s切换翻译服务,如-s deepl
-p只翻指定页码,如-p 1-5
-t设置翻译线程数
--dir批量翻译整个目录
--compatible兼容模式,救复杂排版
--config指定 JSON 配置文件
--serverport更换 GUI 服务端口

把翻译固定进工作流 🔁

把源语言、目标语言、翻译服务、字体路径写进一个 JSON 配置文件,命令里用--config指向它。 默认位置是~/.config/PDFMathTranslate/config.json,配好一次,以后每条翻译命令都复用这套偏好。

文献攒多了就批量跑:

# 一次翻完目录下的所有 PDF pdf2zh --dir /path/to/your/papers/

平时用 Zotero 管文献的话,也可以装 Zotero 插件,在文献库里直接调用 PDFMathTranslate 翻译,省掉手动下载 PDF 这一步。

它最适合正文规整、文本可选中的学术论文和技术文档。 扫描件、手写稿和图文混排的杂志版式不在它的舒适区,硬翻效果会打折扣。

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询