PDFMathTranslate 是当前开源生态中,针对学术 PDF 翻译表现非常优秀的工具方案。它借助 DocLayout-YOLO 识别公式与图表区域,还能按照原始像素位置回填译文,一键生成纯中文 PDF 和中英对照双语 PDF。整个过程中公式不乱码、图表不移位、文档结构也能保持完整。

如果你需要把英文论文 PDF 翻译成中文,同时还要保证公式显示正常、图表位置不偏移、标题层级不混乱、页眉页脚不丢失,那么普通翻译工具往往难以胜任。这类需求通常必须依赖具备文档结构识别与版面还原能力的专业 PDF 翻译工具。
用PDFMathTranslate命令行一键生成双语PDF
这是目前开源工具中对学术 PDF 支持非常稳健的方案之一,无需手动拆页,也不用反复调整参数,整篇论文上传后即可直接翻译。
第一步:在终端执行安装命令(Windows 用户请先安装 Python 3.12+)
pip install pdf2zh
第二步:将论文 PDF 放入终端所在文件夹,运行
pdf2zh paper.pdf
第三步:等待处理完成,当前目录会自动生成两个文件:
paper-mono.pdf(纯中文版)
paper-dual.pdf(中英对照版)
【公式与图表位置和原文保持一致,基本无需额外排版处理】
这一步操作门槛很低,直接把 PDF 文件拖进去即可。它的底层通过 DocLayout-YOLO 模型识别公式区域和图表坐标,再将翻译后的文本按原始像素位置精准回填,因此即使是 LaTeX 渲染的 frac{a+b}{c} 这类公式,也能尽可能按原样保留为可编辑公式。
网页端免安装快速体验(适合临时急需)
方法一:访问 pdf2zh.com 官网 → 点击“上传PDF” → 拖入文件 → 选择“中文” → 点击“开始翻译” → 下载生成的 PDF
方法二:使用 Immersive Translate 的 BabelDOC 服务 → 注册后每月可获得 1000 页免费额度 → 上传后自动启用公式 OCR 识别 → 支持导出带原文高亮的双语 PDF
注意:网页端上传超过 80MB 的 PDF 时可能失败,建议提前使用 Adobe Acrobat 压缩到 60MB 以内,以提高上传成功率。
知云/翻译狗等桌面工具的避坑要点
知云文献翻译虽然支持导入 PDF,但它主要提取文本层内容,遇到扫描版 PDF 或嵌入式公式(如 MathType 对象)时往往会直接跳过,从而导致公式区域留白;翻译狗在多栏排版场景下的识别稳定性也一般,常见问题是把右栏文字错误填入左栏空白区域。
如果你已经安装知云,建议先点击“PDF阅读器”→右键→“识别公式区域”→勾选“启用LaTeX解析”,否则数学符号通常会被统一转成图片,后续无法编辑。
翻译狗在上传前需要手动勾选“学术领域”和“保留图表位置”,否则默认不会开启结构分析模块,最终可能把图表压缩成一张大图并统一放到页末。
