快速结论
PDFMathTranslate 是面向科学论文和技术文档的排版保留型 PDF 翻译项目。它的价值不是把文字抽出来翻译,而是尽量保留公式、图表、目录、脚注和双栏结构,再输出单语译文与双语对照 PDF。项目已经迁入 PDFMathTranslate 官方 GitHub 组织,当前应明确区分两条产品线:稳定版 pdf2zh 1.9.11 适合重视兼容性和既有命令的用户;基于 BabelDOC 的 pdf2zh-next 2.9.0 是 2.x 主线,侧重复杂版面、跨栏跨页语义和持续演进。两者都采用 AGPL-3.0,不能把“代码可免费获取”理解为任意闭源集成。翻译模型、商业 API 或在线服务可能另收费,并可能接收上传文档。
核心功能
- 识别正文、公式、图表、目录和注释,翻译后尽量复原原有版面。
- 输出仅译文 PDF 和原文/译文双语对照 PDF,便于论文精读与术语核验。
- 支持命令行、WebUI、Docker 等使用方式;稳定版还保留批量、指定页码、源语言与目标语言等参数。
- 翻译后端可按配置连接 Google、DeepL、OpenAI 兼容接口或本地模型,不把用户锁在单一提供商。
pdf2zh-next以 BabelDOC 为基础,针对复杂 PDF 兼容性、跨栏跨页语义、动态缩放等问题继续迭代。
适合人群
它最适合需要阅读外文论文、专利说明、技术报告和带大量公式文档的研究者、工程师与学生。对保密文档有要求、愿意本地部署并自行选择翻译后端的团队,也能从中获得更清晰的数据边界。若任务只是翻译几段纯文本,或要求对扫描件、手写内容做到出版级复刻,这套工具可能过重,且仍需 OCR 或人工校对。企业准备把它封装为网络服务时,还必须先评估 AGPL 的网络交互条款与依赖许可。
使用场景
典型用法是把英文论文转成中英对照稿,阅读时保留公式编号、图题和引用位置;也可只处理指定页,快速核对一章报告。实验室可在内网部署 WebUI,结合本地模型处理未公开材料。文献管理用户可评估第三方 Zotero 集成,但插件并不自动继承官方项目的维护承诺。批量翻译会议论文前,建议先拿两三份包含双栏、长公式和复杂表格的样本做验收,因为“版面保留”是尽力而为,不等于每个 PDF 都无损转换。
价格与版本
| 版本/方式 | 软件价格 | 关键区别 |
|---|---|---|
pdf2zh 1.9.11 | 免费 | 稳定的 1.x 包与既有 CLI,适合兼容优先的工作流 |
pdf2zh-next 2.9.0 | 免费 | 官方 2.x 主线,基于 BabelDOC,复杂版面能力与 WebUI 持续演进 |
| 自选翻译 API | 按提供商计费 | token、字符或页数成本由所选模型/翻译商决定 |
| 第三方在线服务 | 免费额度或付费 | 免安装,但配额、保留期限、隐私和服务条款由运营方决定 |
AGPL-3.0 允许使用、研究和修改,但分发修改版或通过网络向用户提供修改后的程序时,通常需要向对应用户提供完整源代码。具体商用方案应由法务结合部署方式判断。软件许可不覆盖模型 API 费用,也不授予待翻译文档、插图、论文或输出译文的版权。
国内访问与使用体验
项目源码、PyPI 包和本地 WebUI 的使用路径相对直接,needsVPN: false 表示产品本身有国内可用的部署方式,并不承诺每个外部翻译提供商都可用。实际体验受三项因素影响:版面解析模型能否下载、翻译后端的延迟与配额、PDF 字体和编码是否规范。敏感文件优先选择本地解析与本地模型;若配置云端翻译 API,文档片段仍会发送给该提供商。使用公共或付费在线实例前,应阅读其隐私政策、文件保留规则、训练用途说明与数据处理协议,不能仅凭“HTTPS”推断文件不会留存。
优点
- 科学文档导向明确,公式、双栏、图表和注释的处理比普通文本翻译更有针对性。
- 1.x 稳定线与 2.x 主线边界清楚,团队可以按兼容性和版面质量选择。
- 可更换翻译服务,也可结合本地模型,在成本、质量和隐私之间做取舍。
- CLI、WebUI、Docker 兼顾个人使用、批处理和团队部署。
- 输出双语对照稿,便于发现术语误译,而不是强迫用户直接接受单一译文。
不足
- 复杂表格、特殊字体、扫描页和异常编码仍可能错位,最终交付前需要逐页检查。
- AGPL-3.0 对闭源产品和托管服务不是“拿来即用”的宽松许可。
- 调用高质量商业模型会产生持续费用,长论文的 token 或字符成本可能明显。
- 在线服务和云端 API 会扩大数据接触面,不适合未经审批上传合同、未发表论文或个人信息。
- 译文不天然拥有再发布权;原文版权、数据库许可、插图授权和合理使用范围仍由用户负责。
替代品对比
| 替代品 | 更适合什么情况 | 相比 PDFMathTranslate 的取舍 |
|---|---|---|
| Ollama | 本地运行模型、强调数据留在设备 | 可作为翻译后端思路,但没有专用 PDF 版面恢复流水线 |
| 夸克 | 国内网页、扫描件和 PDF 综合处理 | 上手更直接,但科研排版翻译的可控性和自部署能力不同 |
| Kimi | 中文长文档阅读、摘要与问答 | 交互分析更方便,不以生成完整双语排版 PDF 为核心 |
| NotebookLM | 围绕指定资料做来源约束的研究 | 资料综合和引用回溯更强,不提供同类版面重建输出 |
| Paperpal | 学术英文润色与投稿检查 | 更聚焦写作质量,不负责整篇论文的双语版面翻译 |
常见问题 FAQ
PDFMathTranslate 1.x 和 2.x 应选哪个?
既有脚本、稳定参数和兼容性优先时选 pdf2zh 1.9.11;愿意采用 BabelDOC 新架构并处理更复杂版面时评估 pdf2zh-next 2.9.0。先用真实样本比较,不要只看版本号。
它完全免费吗?
软件代码免费获取,但商业翻译 API、图像或大模型调用、服务器和第三方在线服务可能收费。
AGPL-3.0 能用于公司项目吗?
可以评估使用,但分发、修改和网络服务场景可能触发源码提供义务。闭源产品集成前应让法务审查具体架构,而不是把 AGPL 当作 MIT。
上传论文会泄露吗?
本地解析不等于全程离线。只要翻译后端是云 API,文本片段就可能离开设备;公共 WebUI 还可能接收整份文件。敏感材料应采用批准的本地模型或签有数据协议的供应商。
翻译后的 PDF 可以直接公开发布吗?
不一定。工具不会替你取得原文、图表、字体或译文再发布授权,也不能消除论文出版商、作者和数据来源的权利。
总结
PDFMathTranslate 值得推荐给真正需要“翻译后还能读懂原版结构”的科研与技术用户。正确采用方式是先选清 1.9.11 稳定线或 2.9.0 主线,再用代表性 PDF 验证版面,最后根据文档敏感度选择本地或云端翻译后端。把 AGPL、API 费用、隐私和文档权利纳入上线清单后,它才是一套可持续的工作流,而不只是一次效果不错的演示。