PDFMathTranslate(pdf2zh)实用指南:一篇科学论文 PDF 全文翻译,公式与双栏排版原样保留
2026/9/16 12:57:40 网站建设 项目流程

PDFMathTranslate(pdf2zh)实用指南:一篇科学论文 PDF 全文翻译,公式与双栏排版原样保留

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

想读外文论文又不想被排版破坏的翻译结果劝退?PDFMathTranslate(命令名pdf2zh)用一条命令翻译科学论文 PDF,公式、图表编号和双栏结构都留在原位,面向需要大量阅读外文文献的学生与科研人员。

🔍 看懂机制:为什么公式不会被译成文字

它不是"找到文字再翻译"的普通翻译工具,而是先做版面检测再翻译:内置的 DocLayout-YOLO 版面检测模型先标出每页中公式、图表、目录、注释的位置,只把纯文本区域交给翻译服务,其余区域原封不动。每份输入会产出两份文档:mono是纯译文,dual是中英文对照版,方便逐段核对。

使用边界先说清楚:

  • 解析的是 PDF 文本层,纯图片扫描件不能直接译,需先走 OCR(项目内置实验性 OCR,见后文)。
  • 默认翻译服务是 Google,无需任何密钥。
  • 首次运行要下载版面模型wybxc/DocLayout-YOLO-DocStructBench-onnx,需要一次联网。
  • 依赖 Python 3.11~3.12,其他版本装不上。

30 秒跑通首次翻译:一条命令拿到双语版

在 PDF 所在目录执行:

pip install pdf2zh pdf2zh document.pdf

当前目录会生成document-mono.pdf(纯译文)和document-dual.pdf(中英对照)。首次运行稍慢,因为在下载版面模型,之后走本地缓存。不愿配 Python 环境的话,也可直接用仓库 release 页的 Windows 版 exe 双击运行。

能力速查:想做什么,查这一行

想做的事命令 / 参数说明
翻译单个 PDFpdf2zh document.pdf默认 Google 服务,免密钥
切换翻译服务-s deepl-s openai:gpt-4o-mini先设DEEPL_AUTH_KEYOPENAI_API_KEY等变量,对照服务变量表
批量处理整个目录pdf2zh --dir ./papers -o results/目录下所有 PDF 一次跑完
只译指定页-p 1-3,5第 1~3 页和第 5 页
指定源/目标语言-li en -lo zh支持英、日、韩、德等十余种语言
加快速度-t 4并发翻译线程数
跳过缓存重译--ignore-cache相同文本默认命中缓存
固定参数便于复用--config config.json批量场景推荐
调整保留的公式字体-f/-c默认保留 Latex、Mono、Code、Italic、Symbol、Math 六类
翻译扫描件pip install 'pdf2zh[ocr]'实验性 OCR,快模式自动识别图片页

📐 核对效果:公式、编号、双栏是否都在原位

翻译前后各截一页对照:

双栏结构、图表编号、脚注和页眉都没有错位;公式区域内的数学符号不会被当作普通文字送去翻译。个别字体输出异常时,用-f指定正则让某类字体整体保留即可,参数写法见高级用法。

🐳 不止命令行:GUI、Docker、MCP 与 API

  • 图形界面pdf2zh -i启动后浏览器打开http://localhost:7860/,拖入 PDF、选服务与页码即可实时预览,详见 GUI 说明。
  • Docker 部署:拉取镜像并映射 7860 端口——
    docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh
  • MCP 服务器pdf2zh --mcp以 STDIO 方式运行,加--sse切换为 SSE,可接入 Claude Desktop 等客户端,配置示例在 ADVANCED.md 的 MCP 小节。
  • 程序化调用:docs/APIS.md 提供 Python API(translate/translate_stream两个函数)与 HTTP API 两种集成方式,HTTP 端需先pip install pdf2zh[backend]

常见卡点:三种典型故障与解法

  • 版面模型下载失败或超时:把HF_ENDPOINT环境变量指向一个模型镜像地址后重跑即可,这是首次运行最常被卡住的环节。
  • 扫描件翻不动:纯图片 PDF 没有文本层,先装pip install 'pdf2zh[ocr]'启用实验性 OCR,或自行用 OCR 工具生成文本层再翻译;手写体和行内公式的识别精度有限。
  • 换服务后报缺密钥或 401:对照服务变量表确认环境变量已设置;OpenAI 兼容接口的BASE_URL必须以/v1结尾,少写就会 404。

行动清单

  1. 先翻一篇短论文,逐页核对dual版本里的公式与分栏位置。
  2. 批量场景把--dir-o组合使用,并用--config固定参数,方便重复执行。
  3. 出问题先查 docs/ADVANCED.md 目录,按小节定位语言、服务、缓存、字体各节。

【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询