PDFMathTranslate(pdf2zh)实用指南:一篇科学论文 PDF 全文翻译,公式与双栏排版原样保留
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
想读外文论文又不想被排版破坏的翻译结果劝退?PDFMathTranslate(命令名pdf2zh)用一条命令翻译科学论文 PDF,公式、图表编号和双栏结构都留在原位,面向需要大量阅读外文文献的学生与科研人员。
🔍 看懂机制:为什么公式不会被译成文字
它不是"找到文字再翻译"的普通翻译工具,而是先做版面检测再翻译:内置的 DocLayout-YOLO 版面检测模型先标出每页中公式、图表、目录、注释的位置,只把纯文本区域交给翻译服务,其余区域原封不动。每份输入会产出两份文档:mono是纯译文,dual是中英文对照版,方便逐段核对。
使用边界先说清楚:
- 解析的是 PDF 文本层,纯图片扫描件不能直接译,需先走 OCR(项目内置实验性 OCR,见后文)。
- 默认翻译服务是 Google,无需任何密钥。
- 首次运行要下载版面模型
wybxc/DocLayout-YOLO-DocStructBench-onnx,需要一次联网。 - 依赖 Python 3.11~3.12,其他版本装不上。
30 秒跑通首次翻译:一条命令拿到双语版
在 PDF 所在目录执行:
pip install pdf2zh pdf2zh document.pdf当前目录会生成document-mono.pdf(纯译文)和document-dual.pdf(中英对照)。首次运行稍慢,因为在下载版面模型,之后走本地缓存。不愿配 Python 环境的话,也可直接用仓库 release 页的 Windows 版 exe 双击运行。
能力速查:想做什么,查这一行
| 想做的事 | 命令 / 参数 | 说明 |
|---|---|---|
| 翻译单个 PDF | pdf2zh document.pdf | 默认 Google 服务,免密钥 |
| 切换翻译服务 | -s deepl或-s openai:gpt-4o-mini | 先设DEEPL_AUTH_KEY、OPENAI_API_KEY等变量,对照服务变量表 |
| 批量处理整个目录 | pdf2zh --dir ./papers -o results/ | 目录下所有 PDF 一次跑完 |
| 只译指定页 | -p 1-3,5 | 第 1~3 页和第 5 页 |
| 指定源/目标语言 | -li en -lo zh | 支持英、日、韩、德等十余种语言 |
| 加快速度 | -t 4 | 并发翻译线程数 |
| 跳过缓存重译 | --ignore-cache | 相同文本默认命中缓存 |
| 固定参数便于复用 | --config config.json | 批量场景推荐 |
| 调整保留的公式字体 | -f/-c | 默认保留 Latex、Mono、Code、Italic、Symbol、Math 六类 |
| 翻译扫描件 | pip install 'pdf2zh[ocr]' | 实验性 OCR,快模式自动识别图片页 |
📐 核对效果:公式、编号、双栏是否都在原位
翻译前后各截一页对照:
双栏结构、图表编号、脚注和页眉都没有错位;公式区域内的数学符号不会被当作普通文字送去翻译。个别字体输出异常时,用-f指定正则让某类字体整体保留即可,参数写法见高级用法。
🐳 不止命令行:GUI、Docker、MCP 与 API
- 图形界面:
pdf2zh -i启动后浏览器打开http://localhost:7860/,拖入 PDF、选服务与页码即可实时预览,详见 GUI 说明。 - Docker 部署:拉取镜像并映射 7860 端口——
docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh - MCP 服务器:
pdf2zh --mcp以 STDIO 方式运行,加--sse切换为 SSE,可接入 Claude Desktop 等客户端,配置示例在 ADVANCED.md 的 MCP 小节。 - 程序化调用:docs/APIS.md 提供 Python API(
translate/translate_stream两个函数)与 HTTP API 两种集成方式,HTTP 端需先pip install pdf2zh[backend]。
常见卡点:三种典型故障与解法
- 版面模型下载失败或超时:把
HF_ENDPOINT环境变量指向一个模型镜像地址后重跑即可,这是首次运行最常被卡住的环节。 - 扫描件翻不动:纯图片 PDF 没有文本层,先装
pip install 'pdf2zh[ocr]'启用实验性 OCR,或自行用 OCR 工具生成文本层再翻译;手写体和行内公式的识别精度有限。 - 换服务后报缺密钥或 401:对照服务变量表确认环境变量已设置;OpenAI 兼容接口的
BASE_URL必须以/v1结尾,少写就会 404。
行动清单
- 先翻一篇短论文,逐页核对
dual版本里的公式与分栏位置。 - 批量场景把
--dir与-o组合使用,并用--config固定参数,方便重复执行。 - 出问题先查 docs/ADVANCED.md 目录,按小节定位语言、服务、缓存、字体各节。
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考