OvisOCR2图片PDF识别精准识别成文字工具

功能介绍

把成堆的扫描件、PDF、截图,一键变成可编辑的 Markdown 或 txt 文档

注意项

解压路径不要包含中文

电脑要求

· Windows 系统

· NVIDIA 显卡(显卡需要 12G), 显卡驱动更新到最新版本

· 显存偏小的显卡,可在「参数设置」中下调并发页数、上下文长度、

它替你解决什么

你手上有 200 页的 PDF 论文、几百张合同扫描件、一沓财报截图,需要把里面的文字、表格、公式全部提取出来,整理成能编辑的文档。

手动敲字 ------ 一整天没了,还容易出错

找在线 OCR ------ 要上传文件,涉密资料不敢传,还按页收费

用传统 OCR ------ 表格散架、公式变乱码、多栏排版读串行

识别效果有多好

底层是开源的 OvisOCR2 模型(仅 0.8B 参数,却相当能打):在权威文档解析榜单 OmniDocBench v1.6 上综合得分 96.58,是首个登顶该榜单的端到端模型 ------ 此前榜首长期被结构复杂的多模块流水线方案占据。

· 正 文 按人类阅读顺序还原,多栏排版不会读串行

· 表 格 输出标准 HTML 表格,合并单元格也能正确还原

· 公 式 输出 LaTeX,可直接粘进 Word / Typora / Obsidian

· 插 图 自动定位图表区域,可裁剪成图片单独导出

为什么值得装

◆ 完 全 离 线

模型跑在你自己的显卡上,文件一个字节都不会离开这台电脑。合同、病历、财报、内部资料,放心处理。不联网,不上传,不计费。

◆ 真 · 批 量

支持整个文件夹递归扫描,几百个文件排队自动跑完。多个文件的页面会自动攒成一批送进显卡,吞吐远高于一个一个处理。

◆ 断 点 续 跑

跑到一半断电了?勾上「跳过已存在的结果文件」再点开始,只补做没完成的部分,已经跑好的不会白费。

◆ 进 度 看 得 见

左边队列实时显示每个文件的状态、页数、耗时;

右边同步预览识别结果 ------ Markdown 渲染效果、原始源码、原图,

三个视图随时切换对照,识别得对不对一眼就知道。

◆ 输 出 即 用

结果与源文件同名,可选保持原有目录层级;

PDF 可整本合并成一个 .md,也可以每页单独成文件。

◆ 界 面 顺 手

拖拽添加、深色 / 浅色主题一键切换、参数改完自动记住。

所有识别参数都在「参数设置」页里,带说明,不用查文档。

适合谁用

· 需要把纸质 / 扫描资料数字化归档的人

· 整理论文、教材、技术手册的研究者与学生

· 处理合同、发票、报表的财务与法务

· 给知识库 / RAG 准备高质量 Markdown 语料的开发者

· 任何受够了「复制 PDF 结果全是乱码」的人

OvisOCR2批量PDF、图片文档识别工具下载链接:

下载链接:https://pan.quark.cn/s/80cbf7006e9f

解压密码: aibbs.fun

相关推荐
一念春风10 小时前
PDF浏览器(阅读、编辑、新建)
pdf
qq_3691736318 小时前
PDF 怎么分享成在线链接?在 AI 助手里一句话发布
pdf·agent·效率工具·ai 工具
开开心心就好18 小时前
视频模糊怎么修复?免费工具支持批量处理
java·前端·人工智能·智能手机·pdf·excel
asdzx6719 小时前
Python 实现从 URL 在线下载 PDF 文档教程
python·pdf
大连好光景1 天前
RAG系统中,如何处理PDF文档中的表格?
pdf·ai-native
SamChan902 天前
PDF页面旋转与CropBox陷阱:译文回填位置总是错位的根因实测
python·ai·pdf·wpf
万物皆智能2 天前
pdf怎么转成图片?分享14种简单的PDF转图片工具
pdf
2501_930707782 天前
使用C#代码更改或删除 PDF 中的超链接
pdf
凤山老林2 天前
Spring Boot 集成 iText 7 实现动态 PDF 生成与电子签章:合同、报表场景实战
spring boot·后端·pdf·itext7·电子签章
泡海椒2 天前
趋势分析报表:jquick-pdf折线图PDF生成实战
java·大数据·运维·服务器·前端·pdf