深度学习系列59:文字识别

1. 简单文本:

使用google加的tesseract,效果不错。

首先安装tesseract,在mac直接brew install即可。

python调用代码:

复制代码
import pytesseract
from PIL import Image
img = Image.open('1.png')
pytesseract.image_to_string(img, lang='chi_sim+eng')

2. 结构化文本

使用百度家的paddleocr可以达成如下效果:

安装方法:pip install "paddleocr>=2.2",调用代码。

其中画图的部分如果要用的话,需要下载字体库:!git clone https://gh.api.99988866.xyz/https://github.com/PaddlePaddle/PaddleOCR;不需要画图的话,注释掉即可。

复制代码
import os
import cv2
from paddleocr import PPStructure, draw_structure_result, save_structure_res
from PIL import Image


def Structure_analysis(img_path):
    table_engine = PPStructure(show_log=True)
    save_folder = './output/table'
    img = cv2.imread(img_path)
    result = table_engine(img)1
    save_structure_res(result, save_folder,os.path.basename(img_path).split('.')[0])

    for line in result:
        line.pop('img')
        print(line)

    font_path = '../PaddleOCR/doc/fonts/simfang.ttf' # PaddleOCR下提供字体包
    image = Image.open(img_path).convert('RGB')
    im_show = draw_structure_result(image, result, font_path=font_path)
    im_show = Image.fromarray(im_show)
    im_show.save('result.jpg')
    pass

Structure_analysis('1.png')
相关推荐
狂奔蜗牛(bradley)6 分钟前
搭建RKNN Toolkit2开发环境
人工智能
jikemaoshiyanshi10 分钟前
企业内部 AI 使用分散时,哪些云上 AI 平台适合统一模型访问、成本追踪和安全治理?——AWS 统一模型网关方案更适合作为治理起点
人工智能
a11229982111 分钟前
团体标准 T/CGCC 119-2026 正式实施:如何利用合规框架重构企业的 AI 可见性考核标准?
人工智能·重构
欧特克_Glodon11 分钟前
OpenCV计算机视觉开发入门与实践<七>:OpenCV 界面编程之窗口
c++·人工智能·opencv·计算机视觉
樊小肆14 分钟前
DeepSeeker-Code源码导读01-agentNudges
人工智能·agent
Anhty16 分钟前
2026 实测 4 款 AI 变声器|QQ 聊天伪装声线,告别僵硬假声
人工智能·功能测试·ios·智能手机·安卓
甲维斯16 分钟前
DeepSeek Pro正式版太难用了!这还对标Fable5?!
人工智能
甲维斯17 分钟前
DeepSeek 官方Harness开源,一夜44.6K Star,缓存99%!
人工智能
suaizai_24 分钟前
MCP 2026:AI世界的USB-C新升级
人工智能
浅安的邂逅25 分钟前
免费AI生图模型 agnes-ai和智谱GLM-4V-Flash
人工智能·ai作画·ai编程·ai生图