
怎么快速把PDF论文译成中文还保住公式和双栏【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate写文献综述遇到一整叠英文论文。用普通机翻工具复制粘贴公式糊成一团双栏排版塌成一行图编号全丢。PDFMathTranslate命令叫pdf2zh就是干这个的PDF 全文翻译公式、图表和双栏结构原样保留翻完直接产出纯译文和中英对照两个文件给要啃外文文献的学生和研究者用。为什么它翻论文不坏公式多数机翻工具眼里只有文字。pdf2zh 翻译前先用版面检测模型DocLayout-YOLO一种识别页面元素位置的小模型把每页切成文本块、公式、图片、表格只有文本块被送进翻译服务公式和图表完全不碰再复杂的分式也不会坏掉。另外两个省事的设计每次跑完生成-mono.pdf纯译文和-dual.pdf中英对照两个文件想逐段核对还是直接读各取一个就行翻译带缓存相同文本只调一次 API重复处理同一批文档时省时省额度。30 秒跑通Python 3.11~3.12 环境装完直接喂一篇论文pip install pdf2zh pdf2zh document.pdf当前目录会多出document-mono.pdf和document-dual.pdf。不想碰命令行的话装完执行pdf2zh -i浏览器打开http://localhost:7860/就是图形界面左边选服务和页码点 Translate右边直接预览译文下载即可。看看翻译出来的效果图里左右分别是同一篇论文的英文原文和中文译文公式编号 (34.32) 到 (34.41) 逐行对上双栏宽度、脚注位置都和原文一致。这就是懂版面的翻译和纯文本机翻的区别读的时候不用来回翻原文找公式。换翻译引擎只改两个参数默认走 Google不用配密钥。想换 DeepL 或 OpenAI先把密钥设成环境变量如DEEPL_AUTH_KEY再用-s指定服务pdf2zh paper.pdf -s deepl pdf2zh paper.pdf -s openai:gpt-4o-mini其余常用参数-p 1-3,5只翻指定页-li/-lo控制源语言和目标语言-t调并发线程数--ignore-cache强制重新翻译。完整参数表和各服务对应的环境变量名在 docs/ADVANCED.md 里查。批量翻一个文件夹的论文文献多时别一篇一篇喂--dir指向目录-o指定输出位置pdf2zh --dir /path/to/papers/ -o results/文件夹里所有 PDF 一次处理完译文落到results/。什么时候会翻车 两个高频翻车点。一是扫描版 PDF它解析的是 PDF 里的文本层纯图片扫描件直接翻不了先过一遍 OCR 再喂给它。二是首次运行要拉取版面检测模型wybxc/DocLayout-YOLO-DocStructBench-onnx网络受限地区可能卡在下载设一下镜像变量再跑set HF_ENDPOINThttps://hf-mirror.com用 Ollama、OpenAI 这类需要密钥的服务时记得密钥提前设成环境变量否则启动就会报错。下次再碰到一整叠待翻的论文就一行pip install pdf2zh挑一篇扔进去看双栏和公式能不能活下来。【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译支持 Google/DeepL/Ollama/OpenAI 等服务提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考