PDFMathTranslate 三步跑通:保留排版的 PDF 全文翻译怎么做 📅 发布时间:2026/9/1 11:36:04 👁 浏览次数: PDFMathTranslate 三步跑通保留排版的 PDF 全文翻译怎么做【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate跑一条命令PDFMathTranslate 的 PDF 翻译会直接产出两个文件一份纯中文单语版、一份中英双语对照版公式、图表、表格和分栏位置与原文逐页一致。不用再手动把 PDF 文字抠出来逐句喂给翻译工具也不用担心公式被翻成一串乱码。概念速览它和普通翻译工具差在哪PDFMathTranslate 是一款免费的开源学术 PDF 翻译工具。它先用版面检测模型看懂页面结构——哪里是正文、哪里是公式和图——再只把纯文本送去做翻译最后把译文写回原位置。这和复制文本再翻译有本质区别产出的文件仍然长得像原文只是换了语言。三步跑通安装与首次翻译第一步安装命令行工具这一步做什么装好pdf2zh命令。操作需 Python 3.11 及以上pip install pdf2zh怎么确认成功终端执行pdf2zh --version能打印出版本号。第二步翻译第一份论文这一步做什么翻译一份英文 PDF默认走 Google 服务无需申请任何密钥。操作pdf2zh paper.pdf怎么确认成功当前目录生成paper-mono.pdf单语和paper-dual.pdf双语。嫌敲命令麻烦的话pdf2zh -i可以启动浏览器图形界面见 docs/README_GUI.md。第三步按需切换翻译引擎这一步做什么质量或网络不满意时用-s参数切换引擎例如pdf2zh paper.pdf -s openai或-s ollama。怎么确认成功运行日志显示走的是新服务且没有鉴权失败或超时。支持的引擎清单在 docs/ADVANCED.md 里有完整表格实现代码位于 pdf2zh/translator.py。效果对比产物长什么样翻译前原页、翻译后的双语页面以及翻译过程中的实时预览⚙️ 两个真实场景在线 API 与本地模型配置文件默认在~/.config/PDFMathTranslate/config.json首次运行自动创建核心是translators数组用于声明各个翻译引擎也可用--config指向其他位置。场景一用在线 API 翻译适用情况手里有模型 API 密钥追求翻译质量。在配置文件中补充{ translators: [ { name: openai, envs: { OPENAI_API_KEY: sk-xxxx, OPENAI_MODEL: gpt-4o-mini } } ] }// 其余保持默认配置之后pdf2zh paper.pdf -s openai即可切到该引擎质量通常优于免费服务代价是每次调用都计费。场景二本地模型离线翻译适用情况论文涉及敏感数据或机器不方便联网需先在本机装好 Ollama 并拉取模型{ translators: [ { name: ollama, envs: { OLLAMA_HOST: http://127.0.0.1:11434, OLLAMA_MODEL: qwen2.5:7b } } ] }然后pdf2zh paper.pdf -s ollama所有请求走本机论文内容不出内网速度取决于你的硬件。 配置不生效排查现象可能原因解决办法改了 config.json 仍按旧值运行同名环境变量的优先级高于配置文件跑一次让程序回写文件或删掉配置重建调用 OpenAI 兼容接口报 404BASE_URL没以/v1结尾在配置里把地址末尾补上/v1输出文件中文乱码、显示方块环境缺少中文字体配置里用NOTO_FONT_PATH指向一份中文字体同一篇论文二次运行快但内容偏旧翻译缓存生效已翻内容不再请求服务加--ignore-cache强制重翻启动卡在模型下载网络无法访问模型托管站点设置HF_ENDPOINT环境变量指向镜像源进阶方向与边界配置文件可同时声明多个引擎按需切换不同的翻译服务翻译缓存默认记住已翻译内容重跑同一篇论文能省下重复的 API 调用把 Web 界面部署给团队用时可用ENABLED_SERVICES限定可选引擎、用HIDDEN_GRADIO_DETAILS避免页面暴露密钥。它适合需要保留公式与版式批量翻译的英文论文精读、建立双语档案不适合扫描版 PDF 的翻译本项目不做 OCR以及只想快速看懂几段话的场景——那用普通翻译工具更直接。更多引擎与参数细节见 docs/ADVANCED.md。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考