PDF 论文翻译上手指南:用 PDFMathTranslate 保留公式与排版 📅 发布时间:2026/9/8 21:55:52 👁 浏览次数: PDF 论文翻译上手指南用 PDFMathTranslate 保留公式与排版【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate有没有这种经历论文用在线工具翻完公式全变乱码双栏排版被打散图表编号和正文对不上对于 PDF 论文翻译这类需求PDFMathTranslate命令名pdf2zh的思路是先用版面检测模型识别页面里哪些是文字、公式、图表只翻译文字部分输出纯译文和中英对照两个 PDF。快速上手3 分钟看到翻译结果前提只有一个本地 Python 版本在3.11到3.12之间。装好就能翻pip install pdf2zh pdf2zh document.pdf几分钟后当前目录会多出document-mono.pdf纯译文和document-dual.pdf中英对照。不想敲命令的话装完执行pdf2zh -i浏览器打开http://localhost:7860/就是图形界面Windows 用户也可以直接拿 release 页的 exe 双击运行。先看效果公式与双栏排版如何被保留下图是官方演示的同一页对照左英文原文、右中文译文右页的双栏结构、公式编号、图表位置都和原文一致像\frac{b}{c} k这类数学符号原样输出不会被拆成乱码。原理是内置的 DocLayout-YOLO 版面检测先把公式、图表区域圈出来只把文字段落送去做 PDF 翻译公式区域原封不动。高频参数速查参数作用示例-p只翻译指定页码pdf2zh a.pdf -p 1-3,5-s更换翻译服务pdf2zh a.pdf -s deepl-li/-lo指定源语言 / 目标语言pdf2zh a.pdf -li en -lo zh-t并发线程数pdf2zh a.pdf -t 4--dir/-o批量翻译文件夹并指定输出目录pdf2zh --dir papers/ -o out/默认服务是 Google无需任何密钥。换 DeepL、OpenAI 或本地 Ollama 时先设好对应的环境变量密钥各服务的变量名一览都在 docs/ADVANCED.md 的表格里冷门选项如--prompt自定义提示词、--config配置文件也在那篇文档中。跑不通怎么办3 个高频故障排查症状首次运行卡在模型下载不动。首次启动要拉取版面检测模型wybxc/DocLayout-YOLO-DocStructBench-onnx部分地区网络受限。先设置镜像源再跑set HF_ENDPOINThttps://hf-mirror.com症状扫描版 PDF 翻完没内容或全是错字。pdf2zh解析的是 PDF 里的文本层纯图片扫描件它取不到文字。这类文件先过一遍 OCR再喂给它就不存在这个问题。症状换用 OpenAI、DeepL 后报错或翻译失败。十有八九是密钥环境变量没设置。按 docs/ADVANCED.md 服务表里对应的变量名设好再用-s指定服务即可。总结一条命令就能开始PDFMathTranslate 把PDF 翻成中文还不丢排版压缩成了一条命令被 EMNLP 2025 收录维护也很活跃。pip install pdf2zh装完拿手边一篇论文跑一下参数不够用时查一查 docs/ADVANCED.md 就足够了。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考