【OCR】 - Tesseract OCR在mac系统中安装

Tesseract OCR

在Mac环境下安装Tesseract OCR(Optical Character Recognition)通常可以通过Homebrew包管理器进行。以下是安装步骤:

安装Homebrew

如果你还没有安装Homebrew,请访问 https://brew.sh/ 并按照页面上的说明安装。

使用Homebrew安装Tesseract

  1. 打开终端(Terminal)应用程序。
  2. 在终端中输入以下命令以安装Tesseract:
bash 复制代码
brew install tesseract

这将下载并安装最新版本的Tesseract,同时可能还会安装一些依赖项。

安装语言包

要在Mac上下载Tesseract的简体中文语言数据包(chi_sim.traineddata),你可以按照以下步骤进行操作:

下载语言数据包

  1. 访问Tesseract官方镜像站点之一:https://github.com/tesseract-ocr/tessdata_fasthttps://github.com/tesseract-ocr/tessdata_best
  2. 在GitHub页面上,找到并点击"Clone or download"按钮,然后选择"Download ZIP"来下载整个项目。
  3. 解压缩下载的ZIP文件,你会看到一个名为 tessdata

安装语言数据包

  • 1.找到Tesseract在Mac上的安装位置。通常情况下,如果你使用Homebrew安装,它可能位于
    /usr/local/Cellar/tesseract/版本号/share/tessdata
  • 2.将解压后的
    tessdata
    chi_sim.traineddata
    tessdata

验证安装

1.打开终端(Terminal)应用程序。

2.输入以下命令以验证是否已经正确安装了Tesseract和简体中文语言数据包:

bash 复制代码
tesseract --version

这将显示你当前安装的Tesseract版本信息。

3.检查可用的语言列表:

bash 复制代码
tesseract --list-langs

如果一切正常,你应该能在输出列表中看到chi_sim。

现在,你就可以使用Tesseract识别简体中文图像了。

相关推荐
西柚与蓝莓1 小时前
【开源开放体系总结】
python
BulingQAQ4 小时前
论文阅读:PET/CT Cross-modal medical image fusion of lung tumors based on DCIF-GAN
论文阅读·深度学习·生成对抗网络·计算机视觉·gan
belldeep4 小时前
python:reportlab 将多个图片合并成一个PDF文件
python·pdf·reportlab
CV-King6 小时前
opencv实战项目(三十):使用傅里叶变换进行图像边缘检测
人工智能·opencv·算法·计算机视觉
禁默6 小时前
2024年计算机视觉与艺术研讨会(CVA 2024)
人工智能·计算机视觉
FreakStudio7 小时前
全网最适合入门的面向对象编程教程:56 Python字符串与序列化-正则表达式和re模块应用
python·单片机·嵌入式·面向对象·电子diy
丶21367 小时前
【CUDA】【PyTorch】安装 PyTorch 与 CUDA 11.7 的详细步骤
人工智能·pytorch·python
春末的南方城市8 小时前
FLUX的ID保持项目也来了! 字节开源PuLID-FLUX-v0.9.0,开启一致性风格写真新纪元!
人工智能·计算机视觉·stable diffusion·aigc·图像生成
_.Switch8 小时前
Python Web 应用中的 API 网关集成与优化
开发语言·前端·后端·python·架构·log4j
一个闪现必杀技8 小时前
Python入门--函数
开发语言·python·青少年编程·pycharm