开源PDF翻译工具PDFMathTranslate

简介

什么是 PDFMathTranslate ?

PDFMathTranslate 是一个用于 PDF 科学论文的翻译工具,旨在保留文档的排版格式。它支持多种翻译服务,如 GoogleDeepLOllamaOpenAI。该工具提供命令行界面(CLI)、图形用户界面(GUI)和 Docker 部署选项,使用户能够方便地翻译 PDF 文件。

主要功能

  • 双语翻译 :支持将 PDF 文档翻译为多种语言。
  • 格式保留:翻译过程中保留公式、图表、目录和注释等格式。
  • 多种使用方式 :可通过命令行、可移植版本、图形界面或 Docker 进行使用。
  • 公共服务:提供在线翻译服务,用户无需安装任何软件。

适用场景:

  • 学术研究人员和学生需要翻译和比较双语文献。
  • 任何需要处理和翻译 PDF 文档的人。

安装

在群晖上以 Docker 方式安装。

在注册表中搜索 pdf2zh ,选择第一个 byaidu/pdf2zh,版本选择 latest

本文写作时, latest 版本对应为 v1.8.8

注意事项

需要确保你的主机能够访问 huggingface.co,否则容器会停止或者不断重启,日志中会看到错误

log 复制代码
pdfmt    |   File "/usr/local/lib/python3.12/site-packages/urllib3/connectionpool.py", line 369, in _raise_timeout
pdfmt    |     raise ReadTimeoutError(
pdfmt    | urllib3.exceptions.ReadTimeoutError: HTTPSConnectionPool(host='huggingface.co', port=443): Read timed out. (read timeout=1)

或者

log 复制代码
pdfmt    | huggingface_hub.errors.LocalEntryNotFoundError: An error happened while trying to locate the file on the Hub and we cannot find the requested files in the local cache. Please check your connection and try again or make sure your Internet connection is on.

docker 文件夹中,创建一个新文件夹 pdfmt,并在其中建两个子文件夹 inputoutput

其实不用命令行的话,可以用不着输入、输出目录

文件夹 装载路径 说明
docker/pdfmt/input /input 输入文件目录
docker/pdfmt/output /output 输出文件目录

端口

本地端口不冲突就行,不确定的话可以用命令查一下

bash 复制代码
# 查看端口占用
netstat -tunlp | grep 端口号
本地端口 容器端口
7860 7860

命令行安装

如果你熟悉命令行,可能用 docker cli 更快捷

bash 复制代码
# 新建文件夹 pdfmt 和 子目录
mkdir -p /volume1/docker/pdfmt/{input,output}

# 进入 pdfmt 目录
cd /volume1/docker/pdfmt

# 运行容器
docker run -d \
   --restart unless-stopped \
   --name pdfmt \
   -p 7860:7860 \
   -v $(pwd)/input:/input \
   -v $(pwd)/output:/output \
   byaidu/pdf2zh

也可以用 docker-compose 安装,将下面的内容保存为 docker-compose.yml 文件

yaml 复制代码
version: '3'

services:
  pdfmt:
    image: byaidu/pdf2zh
    container_name: pdfmt
    restart: unless-stopped
    ports:
      - "7860:7860"
    volumes:
      - ./input:/input
      - ./output:/output

然后执行下面的命令

bash 复制代码
# 新建文件夹 pdfmt 和 子目录
mkdir -p /volume1/docker/pdfmt/{input,output}

# 进入 pdfmt 目录
cd /volume1/docker/pdfmt

# 将 docker-compose.yml 放入当前目录

# 一键启动
docker-compose up -d

运行

在浏览器中输入 http://群晖IP:7860 就能看到主界面

老苏随便找了一篇英文的文档

下载地址:https://www.jsme.or.jp/conference/PRTEC2024/submission/240329-PRTEC2024-template.pdf

软件的使用不复杂,所以下面只简单的介绍下 AI 模型的设置

Google 模型

pdf 文件拖入,用了默认的 google 模型,为了快速, Pages 中选择了单页,用了 First,也就是只翻译首页

如果网络访问 google 没问题的话,还是非常快的

如果网络不行,可以试试本地的大模型

Ollama 模型

还可以选择其他的 AI 服务,老苏的机器上正好有 Ollama

文章传送门:本地大模型运行框架Ollama

模型用了 qwen2.5:1.5b

  • ServiceOllama
  • OLLAMA_HOSThttp://192.168.0.197:11434
  • OLLAMA_MODELqwen2.5:1.5b

翻译完成后

OpenAI 模型

另外试了下 OpenAI 兼容的模型

文章传送门:

模型设置参数设置

  • OPENAI_BASE_URLhttp://192.168.0.197:3033/v1 , 这是老苏机器上 One API 的地址
  • OPENAI_API_KEYsk-7tB7PvWBs8oWUFJLFaF5F8EfC4Db43Ba9dE18698A0929c47 , 这是 One API 中的令牌
  • OPENAI_MODELkimi,这是 One API 中为 kimi-free-api 设置的模型名称

左侧会生成两个文件

其中 Mono 是翻译后的版本, Dual 是对照的版本

参考文档

Byaidu/PDFMathTranslate: PDF scientific paper translation with preserved formats - 基于 AI 完整保留排版的 PDF 文档全文双语翻译,支持 Google/DeepL/Ollama/OpenAI 等服务,提供 CLI/GUI/Docker

地址:https://github.com/Byaidu/PDFMathTranslate
PDFMathTranslate - PDF Translation with preserved formats

地址:https://pdf2zh.com/

相关推荐
鸭鸭鸭进京赶烤3 分钟前
物联网革新,智慧城市未来揭秘
人工智能·物联网·智慧城市·能源·边缘计算·信息与通信·交通物流
Flash Bomb4227 分钟前
自然语言处理(21:(第六章1.)基于RNN生成文本)
人工智能·rnn·深度学习·神经网络·自然语言处理
梦姐的编程日志12 分钟前
从研究动机视角对无监督图像去雾论文的分类
图像处理·人工智能·深度学习·算法·计算机视觉
Y1nhl14 分钟前
搜广推校招面经六十二
人工智能·pytorch·python·算法·机器学习·推荐算法·搜索算法
inxunoffice1 小时前
批量提取 PDF 文档中指定页为新的 PDF 文档
pdf
inxunoffice1 小时前
批量在多个 PDF 的指定位置插入页,如插入封面、插入尾页
前端·pdf
进取星辰1 小时前
PyTorch 深度学习实战(28):对比学习(Contrastive Learning)与自监督表示学习
人工智能·深度学习
阿珊和她的猫1 小时前
AIGC 与 Agentic AI:生成式智能与代理式智能的技术分野与协同演进
人工智能·aigc
飞凌嵌入式1 小时前
从DeepSeek到Qwen,AI大模型的移植与交互实战指南
人工智能·aigc·嵌入式
不吃香菜?1 小时前
OpenCV图像处理基础到进阶之高阶操作
图像处理·人工智能·opencv