Umi-OCR v2下载、安装、使用教程 (批量图片转文字工具)

前言

OCR图片转文字识别软件,完全离线。截屏/批量导入图片,支持多国语言、合并段落、竖排文字。可排除水印区域,提取干净的文本。基于 PaddleOCR 。

一、下载地址

下载链接: http://source/download 选择如下图红色框文件内容下载

二、安装步骤

1、解压后将Umi-OCR.exe发送到桌面快捷方式

2、点击桌面快捷方式

3、正常启用

三、使用步骤

1、以批量文档OCR识别为例,将图片型的pdf拖入到左侧

2、设置要转换的页数,默认是识别所有的,我这里选择特定页数(第4页),如下图,点击页数后会跳出弹出框进行设置

3、设置排版解析方案,我试了下,选择【单栏-总是换行】效果会更好,后续解析入库方便

4、点击【开始任务】,任务执行结束后查看记录

总结

其他功能页感兴趣的小伙伴可以自己研究下,目前这个只有window版本,有一定的局限性,我目前用的项目场景是,用vue做个按钮触发一个.bat的脚本,然后将文件批量上传到这里,接着将解析后的文件进行解析入库

相关推荐
巡山小钻风来也7 小时前
【保姆级教程】自定义数据集微调PP-OCRv6文本检测模型
python·ocr·paddlepaddle
山顶夕景1 天前
【文档解析】2026年技术发展和趋势
ocr·文档解析·agentic
楚识科技1 天前
云端 API 与私有化 OCR 的架构取舍:数据边界、并发模型与成本测算
ocr
AI人工智能+2 天前
基于深度学习的车辆合格证识别技术,通过图像预处理、文字检测、文字识别到结构化提取、后处理校验,实现车辆合格证信息的结构化提取
深度学习·自然语言处理·ocr·车辆合格证识别
楚识科技3 天前
卡证OCR识别实战:证件识别SDK、端侧设备与私有化部署清单
ocr
晴空蓝天3 天前
零工系统企业认证:营业执照 OCR 识别,阿里云这个接口我调了一下午
阿里云·ocr
苏苏susuus3 天前
核密度估计(KDE)与高斯核(概念分享)
人工智能·python·ocr
庖丁AI4 天前
PDF跨页表格提取后错列怎么办?先检查表头、续行和单位
pdf·ocr·文档解析·表格解析
AI人工智能+5 天前
了一种融合OCR与大模型的文档抽取系统,解决传统OCR“识字不识意”的痛点
深度学习·计算机视觉·语言模型·自然语言处理·ocr·文档抽取