如何不伤排版做 PDF 全文翻译:PDFMathTranslate 快速上手完整指南

发布时间:2026/9/20 3:42:27
如何不伤排版做 PDF 全文翻译:PDFMathTranslate 快速上手完整指南 如何不伤排版做 PDF 全文翻译PDFMathTranslate 快速上手完整指南【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslatePDFMathTranslate命令行名为 pdf2zh是一款 AI 驱动的 PDF 全文翻译工具把外文论文整篇译成目标语言公式、图表、目录与注释的排版原样保留帮你快速拿到一份能直接阅读的中文版文档。三类人三种真实困扰想象你刚下载了一整篇英文论文想尽快读完复制正文丢进翻译软件公式全散、表格错位读起来反而更费劲。你需要的是把 PDF 丢进去就吐出一份排版完好的译文。也有人精读文献要求每个公式、每条脚注的位置都和原文逐页一致翻译结果要能当笔记引用。还有实验室想把翻译服务架到一台服务器上成员打开浏览器就能翻谁都不用在自己电脑上装环境。这三类需求它都覆盖了用 Zotero 管理文献的同学还可以装配套插件把翻译直接嵌进文献管理的工作流里。 先选路再动手三种方式怎么选判断标准其实就一个问题这份 PDF 是谁、在什么场景下翻图形界面GUI自己临时翻几篇零门槛拖文件进网页就行Docker 容器给团队共享服务器装一次其他人浏览器访问命令行CLI要批量、要自动化串进脚本定时跑。按这个思路下面三条路线各走一遍。图形界面打开浏览器就能翻前提是 Python 3.10–3.12 环境装包只要一条命令pip install pdf2zh然后启动图形界面pdf2zh -i程序会在本地起一个 Web 服务浏览器没自动打开就手动访问http://localhost:7860拖入 PDF、等待、下载译文全程不用碰任何参数。命令行翻完直接产出文件# 默认 Google 服务译文存到当前目录 pdf2zh paper.pdf # 换 DeepL 引擎只翻第 1-5 页 pdf2zh paper.pdf -s deepl -p 1-5结果文件生成在当前工作目录一条命令就能写进脚本做自动化。Docker 一键部署共享翻译服务服务器上不用装 Python直接拉官方镜像docker pull byaidu/pdf2zh docker run -d -p 7860:7860 byaidu/pdf2zh启动后团队成员访问http://服务器IP:7860浏览器里就能翻译各台电脑都不用装任何东西。排版为什么不会散它不走逐句替换文字的捷径而是四步先用版式模型识别页面结构把公式、图表、表格区域整体圈出来保护只对普通正文做翻译译完再按原坐标回填到页面上。所以翻完的 PDF 和原文档结构基本一致——下面是同一篇论文用 DeepL 翻译前后的对比。⚡ 翻译引擎怎么选云服务还是本地模型内置接口分两档按需求挑档位服务适合场景云服务Google默认、DeepL 免费档日常阅读开箱即用云服务DeepL Pro、OpenAI追求质量的生产场景本地模型Ollama、Xinference跑开源模型数据不出内网切换只需在命令后加一个-s参数例如-s ollama、-s openai各服务需要设置的环境变量见 docs/ADVANCED.md。进阶参数速查参数适用场景示例--compatible复杂排版普通模式翻不动时开兼容模式pdf2zh doc.pdf --compatible-t大文件慢加翻译线程提速pdf2zh doc.pdf -t 4-p只翻译部分页码pdf2zh doc.pdf -p 1-5--dir批量翻译目录下所有 PDFpdf2zh --dir ./papers/--prompt为 LLM 类服务指定翻译提示词pdf2zh --prompt prompt.txt--config术语词典、字体、代理等长期复用pdf2zh --config config.json专业术语固定译法、字体排版、代理设置这类偏好建议写成配置文件后用--config指向它完整字段说明见 docs/ADVANCED.md。 排障速览症状与解法首次运行模型下载失败→ 程序要拉取一个版式识别模型网络受限时切到镜像站点再试# Linux/Mac export HF_ENDPOINThttps://hf-mirror.com # Windows PowerShell $env:HF_ENDPOINT https://hf-mirror.com复杂排版报错或效果差→ 加--compatible用兼容模式翻一遍大文件翻得太慢→-t 4加线程目录里多份文献用--dir批量跑GUI 起不来或端口被占→ 默认端口是 7860用--serverport换一个再启动。延伸资源与文档完整文档全部参数与语言代码docs/README_zh-CN.md二次开发与 API 集成docs/APIS.md进阶用法细节docs/ADVANCED.md社区参与规范docs/CODE_OF_CONDUCT.md从精读一篇论文到批量处理整个文件夹把上面的命令按场景套进自己的流程语言这一关基本就过去了。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考