PDFMathTranslate 完整使用指南:如何在本地快速完成 PDF 科学文档翻译
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
PDFMathTranslate(pdf2zh)是一款基于 AI 的 PDF 全文翻译工具:它把外文论文翻译成目标语言,同时完整保留公式、图表、目录和注释,让排版不因为翻译而散架。支持 Google、DeepL、OpenAI、Ollama 等多种翻译服务,图形界面、Docker 容器、命令行三种方式都能跑起来。
它解决了什么,谁需要它
做科研的人大概都遇到过这种困境:下载了一篇关键论文,正文是英文,公式和图表排版精美,可一旦用普通工具翻译,公式错位、表格断裂、目录失效,读完比不读还费劲。
PDFMathTranslate 走的是"先解析版式、再翻译文字、最后回填原位"的路线,翻译完的 PDF 与原文档结构基本一致。下面几类人会用到它:
- 学生:批量读外文文献,需要快速拿到可读的中文版本;
- 研究人员:精读论文,要求公式、图表、注释位置完全不动;
- 团队或实验室:想在服务器上搭一个共享的翻译服务,成员浏览器访问即可使用。
此外,它还提供 Zotero 插件,可以把翻译直接嵌进文献管理工作流。
三步跑起来:从图形界面到命令行
无论选哪种方式,核心安装命令都是同一句:
pip install pdf2zh前置条件是 Python 3.10–3.12 环境。装好后按自己的使用习惯选一条路径。
新手路线:图形界面(GUI)
pdf2zh -i执行后程序会启动一个本地 Web 服务。如果浏览器没有自动打开,手动访问http://localhost:7860即可,拖入 PDF、等待、下载译文。
服务器路线:Docker 一键部署
团队共享或服务器环境不建议在每台机器上装 Python,直接用官方镜像:
docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh启动后访问http://服务器IP:7860,团队成员无需安装任何东西,浏览器里就能翻译。
终端路线:命令行直接翻
# 基本用法,译文输出到当前目录 pdf2zh your_document.pdf # 指定翻译服务 pdf2zh your_document.pdf -s deepl # 只翻译部分页面 pdf2zh your_document.pdf -p 1-5命令行生成的结果文件位于当前工作目录,一条命令即可串联进脚本做自动化。
效果展示:翻译前后版式对比
下面是用 DeepL 服务翻译一篇 Nature 论文的结果。左边是原文,右边是译文:
对比可以看出:正文换成了中文,公式、图表、页面布局保持原样。这套能力来自它的版式解析流程——先用布局模型识别页面结构,把公式、图表区域整体保护起来,只对普通正文做翻译,最后按原坐标回填。
翻译引擎方面,内置接口覆盖面很广:Google、DeepL 免费档适合日常使用;DeepL Pro、OpenAI API 适合追求质量的生产场景;Ollama、Xinference 支持本地开源模型,数据和算力都在自己手里。切换服务只需加一个-s参数,详见 docs/ADVANCED.md。
进阶调优速查
常用高级参数一张表,命令与 docs/ADVANCED.md 保持一致:
| 场景 | 命令 | 说明 |
|---|---|---|
| 兼容模式 | pdf2zh complex_document.pdf --compatible | 复杂排版文档翻不动时开启 |
| 多线程提速 | pdf2zh large_document.pdf -t 4 | 调整翻译线程数,大文件提速 |
| 部分页码翻译 | pdf2zh your_document.pdf -p 1-5 | 只翻译指定页面 |
| 批量处理 | pdf2zh --dir /path/to/your/papers/ | 一次翻完目录下所有 PDF |
| 自定义提示词 | pdf2zh --prompt [prompt.txt] | 为 LLM 类服务指定翻译提示 |
| 专业术语词典 | 通过--config指定配置文件 | 固定术语译法、字体与排版参数 |
其中"专业术语词典、字体排版、代理设置"这类偏好,建议写成配置文件后长期复用,命令行里用--config指向它即可,完整字段说明见官方文档 docs/ADVANCED.md。
常见问题自查
Q:安装后运行报模型下载失败?程序首次运行需要拉取一个 AI 布局模型,网络受限时可切到镜像站点再试:
# Linux/Mac export HF_ENDPOINT=https://hf-mirror.com # Windows (PowerShell) $env:HF_ENDPOINT = "https://hf-mirror.com"Q:复杂排版的 PDF 翻译效果不好、甚至报错?先加--compatible用兼容模式翻一遍:
pdf2zh complex_document.pdf --compatibleQ:大文件翻译太慢?用-t调线程数,比如-t 4;多份文献则直接用--dir批量跑。
Q:GUI 起不来或端口被占用?默认端口是 7860,可用--serverport换一个端口再启动。
资源与延伸
- 官方文档(完整功能与参数说明):docs/README_zh-CN.md
- 二次开发与集成参考:docs/APIS.md
- 参与项目的方式与社区规范:docs/CODE_OF_CONDUCT.md
从单篇精读到批量文献处理,把上面的命令按场景套进日常工作流,语言障碍这一关基本就过去了。
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考