17K star!开源免费的离线OCR工具

平时工作中,总会遇到想对图片内文字进行处理的情况,我们就来介绍一款开源、免费的离线OCR工具,它就是:Umi-OCR。

关于 Umi-OCR

Umi-OCR是开源、免费的离线OCR软件。支持截屏/粘贴/批量导入图片,段落排版/排除水印,扫描/生成二维码。项目内置多国语言库,方便切换。

Umi-OCR支持两种内核,一种是PaddleOCR,另一种是RapidOCR。

工具包括的主要功能有:

  • 截图OCR:识别图中的文字,还支持段落合并、鼠标划选等功能。
  • 批量OCR:支持批量导入本地图片并识别
  • 二维码:可截图/粘贴/拖入本地图片,读取其中的二维码、条形码
  • 文档识别:支持导入多种格式的文件进行识别。
  • 调用接口:支持CLI和HTTP接口

目前项目在GitHub已经获得17K+ star,项目发布时间不长,增长趋势在OCR类产品里是比较不错的。

为什么用 Umi-OCR

为什么要使用Umi-OCR呢,我们来说一说:

  • 开源免费:不是OCR工具用不起,而是开源更有性价比,不花钱,还不用看些乱七八糟的广告,难道不香么。
  • 开箱即用:安装后无需什么配置即可使用,快速上手。
  • 体验好:在机器效率不错的情况下,Umi-OCR效率很好,用本地工具总比用一些服务要方便很多。
  • 有可玩性:提供了HTTP接口,可以自己做一些扩展,如果还不满足,那也可以从源码下手。

如何使用 Umi-OCR

项目支持Windows7 x64 及以上,因此只有windows用户可以使用了。

首先在项目release页面可以下载安装包:

Paddle 引擎插件版性能好,速度快,占用率高,适合高配机器。Rapid 引擎插件版速度稍慢,内存占用低,适合低配机器,兼容性好。

图片OCR

这是最常用的功能了,提供了很多实用的功能设置,并且转换速度很不错,很快就能得到结果。

批量OCR

批量OCR可以帮助处理多个任务,还可以设置处理后动作,直接保存不同类型的结果文件。

文档识别

除了对图片,还可以对PDF等类型的文件进行OCR,也同样支持批量操作。支持的文件格式有:pdf, xps, epub, mobi, fb2, cbz

二维码

可截图/粘贴/拖入本地图片,读取其中的二维码、条形码

接口调用

可以启动本地的服务来提供HTTP的API接口,具体参考文档来使用:

github.com/hiroi-sora/...

项目信息

相关推荐
小白学大数据20 小时前
把 Modbus 轮询塞进 Trio 的异步循环:内存映射与定时采集实战
网络·python·搜索引擎
FriendshipT21 小时前
Ubuntu 20.04 下使用 Ollama 本地部署 AI 大模型
linux·人工智能·python·深度学习·ubuntu
在水一缸21 小时前
从“反向技能“到协作革命:当开源重新定义AI编程助手
开源·github·ai编程·开发者工具·ai编程助手·ai协作·claude cowork
天天爱吃肉821821 小时前
# 商用车多体动力学实战笔记|第7篇:制动系统与制动热衰退、ABS滞环控制
大数据·人工智能·笔记·python·嵌入式硬件·汽车
bamb0021 小时前
一个项目带你入门AI应用开发08
python
鸿芯微控科技21 小时前
MFC质量流量控制器流量不准怎么排查?设定值、反馈值与参考流量对比,附Python代码
c++·python·mfc
大尚来也21 小时前
用 Python 自动整理文件、重命名、分类电脑文件夹
开发语言·python
极序时代GEO品牌优化21 小时前
杭州极序时代|面向地域、设备与用户画像的动态GEO
人工智能·python·算法·极序时代geo
qq_22589174661 天前
基于Python的外卖订单数据分析可视化系统
python·信息可视化·django
MC皮蛋侠客1 天前
SQLAlchemy 系列(三):声明式映射与 Schema——让类型、默认值和约束一致
数据库·python