Umi-OCR图片批量识别工具教程

基于 PaddleOCR 。可识别图片,完全离线。截屏/批量导入图片,支持多国语言、合并段落。
(文末附安装下载地址)
演示版本

一、安装步骤

1、解压后将Umi-OCR.exe发送到桌面快捷方式

2、点击桌面快捷方式

3、正常启用

二、使用步骤

1、以批量文档OCR识别为例,将图片型的pdf拖入到左侧

2、设置要转换的页数,默认是识别所有的,我这里选择特定页数(第4页),如下图,点击页数后会跳出弹出框进行设置。

3、设置排版解析方案,我试了下,选择【单栏-总是换行】效果会更好,后续解析入库方便

4、点击【开始任务】,任务执行结束后查看记录

安装包下载地址https://pan.quark.cn/s/53201f885ea9?pwd=Z44u
提取码:Z44u

相关推荐
Code_流苏2 小时前
Pot:免费开源的跨平台划词翻译和 OCR 工具,选中文字就能翻译
开源·ocr·pot·自动翻译·翻译工具·划词翻译
lupai15 小时前
增值税发票 OCR 识别 API 新手接入指南
java·前端·ocr
AI人工智能+16 小时前
通用表格识别:实现从非结构化图像到高保真数据的转换,提升业务流程自动化水平
深度学习·自然语言处理·ocr·表格识别
10mAh2 天前
【PaddleOCR】扫描版 PDF 无法复制、RAG 检索为空怎么解决?——OCR 解析与版面还原实战
前端·pdf·ocr
AI人工智能+2 天前
智能文档抽取系统通过“视觉感知+大模型认知“双引擎架构,实现非结构化文档的自动化处理
深度学习·计算机视觉·语言模型·自然语言处理·ocr·文档抽取
zyplayer-doc5 天前
同一份制度别复制到多个知识库:用zyplayer-doc引用文档解决重复维护
javascript·人工智能·智能手机·开源·ocr
zyplayer-doc6 天前
核心制度不该被随手修改:用zyplayer-doc锁定文档和全部子文档
大数据·数据库·人工智能·笔记·pdf·ocr
一个王同学6 天前
从零到一 | CV转多模态大模型 | week21 | 实战项目-DocuMind-VL:基于 OCR 与 Qwen-VL 的文档多模态问答系统(一)
人工智能·深度学习·计算机视觉·ocr·vllm
Sinosecu-OCR7 天前
文通OCR技术深度解析:自研算法如何搞定复杂场景识别?
算法·ocr·ocr识别系统
AI人工智能+7 天前
一种高效、精准的不动产权证书智能识别技术,打通了物理世界与数字世界的信息壁垒
深度学习·计算机视觉·自然语言处理·ocr·不动产权证书识别