怎么快速把PDF论文译成中文还保住公式和双栏
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
写文献综述,遇到一整叠英文论文。用普通机翻工具复制粘贴,公式糊成一团,双栏排版塌成一行,图编号全丢。PDFMathTranslate(命令叫pdf2zh)就是干这个的:PDF 全文翻译,公式、图表和双栏结构原样保留,翻完直接产出纯译文和中英对照两个文件,给要啃外文文献的学生和研究者用。
为什么它翻论文不坏公式
多数机翻工具眼里只有"文字"。pdf2zh 翻译前先用版面检测模型(DocLayout-YOLO,一种识别页面元素位置的小模型)把每页切成文本块、公式、图片、表格,只有文本块被送进翻译服务,公式和图表完全不碰,再复杂的分式也不会坏掉。
另外两个省事的设计:每次跑完生成-mono.pdf(纯译文)和-dual.pdf(中英对照)两个文件,想逐段核对还是直接读,各取一个就行;翻译带缓存,相同文本只调一次 API,重复处理同一批文档时省时省额度。
30 秒跑通
Python 3.11~3.12 环境,装完直接喂一篇论文:
pip install pdf2zh pdf2zh document.pdf当前目录会多出document-mono.pdf和document-dual.pdf。不想碰命令行的话,装完执行pdf2zh -i,浏览器打开http://localhost:7860/就是图形界面:
左边选服务和页码,点 Translate,右边直接预览译文,下载即可。
看看翻译出来的效果
图里左右分别是同一篇论文的英文原文和中文译文:公式编号 (34.32) 到 (34.41) 逐行对上,双栏宽度、脚注位置都和原文一致。这就是"懂版面的翻译"和纯文本机翻的区别,读的时候不用来回翻原文找公式。
换翻译引擎只改两个参数
默认走 Google,不用配密钥。想换 DeepL 或 OpenAI,先把密钥设成环境变量(如DEEPL_AUTH_KEY),再用-s指定服务:
pdf2zh paper.pdf -s deepl pdf2zh paper.pdf -s openai:gpt-4o-mini其余常用参数:-p 1-3,5只翻指定页,-li/-lo控制源语言和目标语言,-t调并发线程数,--ignore-cache强制重新翻译。完整参数表和各服务对应的环境变量名在 docs/ADVANCED.md 里查。
批量翻一个文件夹的论文
文献多时别一篇一篇喂,--dir指向目录,-o指定输出位置:
pdf2zh --dir /path/to/papers/ -o results/文件夹里所有 PDF 一次处理完,译文落到results/。
什么时候会翻车
🛠 两个高频翻车点。一是扫描版 PDF:它解析的是 PDF 里的文本层,纯图片扫描件直接翻不了,先过一遍 OCR 再喂给它。二是首次运行要拉取版面检测模型wybxc/DocLayout-YOLO-DocStructBench-onnx,网络受限地区可能卡在下载,设一下镜像变量再跑:
set HF_ENDPOINT=https://hf-mirror.com用 Ollama、OpenAI 这类需要密钥的服务时,记得密钥提前设成环境变量,否则启动就会报错。
下次再碰到一整叠待翻的论文,就一行pip install pdf2zh,挑一篇扔进去,看双栏和公式能不能活下来。
【免费下载链接】PDFMathTranslate[EMNLP 2025 Demo] PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/MCP/Docker/Zotero项目地址: https://gitcode.com/GitHub_Trending/pd/PDFMathTranslate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考