Tesseract OCR 安装

Tesseract OCR 的安装步骤因操作系统的不同而有所区别。以下是针对 Windows、macOS 和 Linux 系统的详细安装指导。

1. Windows

步骤:

  1. 下载 Tesseract 安装程序

  2. 安装 Tesseract

    • 双击下载的安装程序,按照提示完成安装。默认安装路径通常为 C:\Program Files\Tesseract-OCR
  3. 配置环境变量

    • 将 Tesseract 的安装路径添加到系统的 PATH 环境变量中,以便在命令行中可以直接调用 tesseract

      • 右键点击"此电脑" -> "属性" -> "高级系统设置" -> "环境变量"。
      • 在"系统变量"中找到 Path,选择后点击"编辑",然后添加 Tesseract 安装目录(如 C:\Program Files\Tesseract-OCR)。
  4. 下载语言包(可选)

    • 默认情况下,只包含英语语言包。如果需要其他语言,可以从 Tesseract Language Data 页面 下载所需的语言文件,并将其放置在 Tesseract-OCR\tessdata 目录下。

2. macOS

步骤:

  1. 使用 Homebrew 安装

    • 打开终端并输入以下命令以安装 Tesseract:
      brew install tesseract
  2. 安装语言包(可选)

    • 如果需要其他语言支持,可以使用以下命令来安装:
      brew install tesseract-lang

3. Linux (以 Ubuntu 为例)

步骤:

  1. 更新软件包列表

    sudo apt update

  2. 安装 Tesseract

    sudo apt install tesseract-ocr

  3. 安装额外的语言包(可选)

    • 例如,安装简体中文语言包:
      sudo apt install tesseract-ocr-chi-sim

验证安装

安装完成后,可以通过运行以下命令来验证 Tesseract 是否成功安装:

tesseract --version

如果能看到版本信息,则表示安装成功。

基本使用示例

提取图像中的文本,可以使用如下命令:

tesseract image.png output.txt

上面的命令会从 image.png 中提取文本并将结果保存至 output.txt 文件中。


希望这些步骤能够帮助你顺利安装 Tesseract OCR!如有任何问题,请随时询问。

相关推荐
Xxtaoaooo8 小时前
OCR文字识别前沿:PaddleOCR/DBNet++的端到端文本检测与识别
人工智能·ai·ocr·文本检测·dbnet++
Jump 不二11 小时前
百度 PaddleOCR 3.0 深度测评:与 MinerU 的复杂表格识别对决
人工智能·深度学习·百度·ocr
GPUStack12 小时前
0.9B PaddleOCR-VL 登顶 SOTA!GPUStack 高效推理部署实战指南
大模型·ocr·paddleocr·多模态模型·模型推理
你板子冒烟了1 天前
JJJ:SD 卡中的 OCR(Operating Conditions Register)寄存器
ocr
扶尔魔ocy1 天前
python程序打包成win的exe应用(以OCR应用为例)
python·ocr·中文识别
rannn_1112 天前
【学以致用|python自动化办公】OCR批量识别自动存为Excel(批量识别发票)
python·ocr·excel·财务
momo_al2 天前
Umi-OCR制作双层PDF
pdf·ocr
余俊晖3 天前
多模态大模型OCR幻觉缓解思路:DianJin-OCR-R1通过“再看一眼”图像减轻幻觉
人工智能·ocr
AI人工智能+4 天前
药品经营许可证识别技术:通过深度学习算法实现资质文件的自动化识别与核验
人工智能·深度学习·ocr·药品经营许可证识别