OvisOCR2图片PDF识别精准识别成文字工具

功能介绍

把成堆的扫描件、PDF、截图,一键变成可编辑的 Markdown 或 txt 文档

注意项

解压路径不要包含中文

电脑要求

· Windows 系统

· NVIDIA 显卡(显卡需要 12G), 显卡驱动更新到最新版本

· 显存偏小的显卡,可在「参数设置」中下调并发页数、上下文长度、

它替你解决什么

你手上有 200 页的 PDF 论文、几百张合同扫描件、一沓财报截图,需要把里面的文字、表格、公式全部提取出来,整理成能编辑的文档。

手动敲字 ------ 一整天没了,还容易出错

找在线 OCR ------ 要上传文件,涉密资料不敢传,还按页收费

用传统 OCR ------ 表格散架、公式变乱码、多栏排版读串行

识别效果有多好

底层是开源的 OvisOCR2 模型(仅 0.8B 参数,却相当能打):在权威文档解析榜单 OmniDocBench v1.6 上综合得分 96.58,是首个登顶该榜单的端到端模型 ------ 此前榜首长期被结构复杂的多模块流水线方案占据。

· 正 文 按人类阅读顺序还原,多栏排版不会读串行

· 表 格 输出标准 HTML 表格,合并单元格也能正确还原

· 公 式 输出 LaTeX,可直接粘进 Word / Typora / Obsidian

· 插 图 自动定位图表区域,可裁剪成图片单独导出

为什么值得装

◆ 完 全 离 线

模型跑在你自己的显卡上,文件一个字节都不会离开这台电脑。合同、病历、财报、内部资料,放心处理。不联网,不上传,不计费。

◆ 真 · 批 量

支持整个文件夹递归扫描,几百个文件排队自动跑完。多个文件的页面会自动攒成一批送进显卡,吞吐远高于一个一个处理。

◆ 断 点 续 跑

跑到一半断电了?勾上「跳过已存在的结果文件」再点开始,只补做没完成的部分,已经跑好的不会白费。

◆ 进 度 看 得 见

左边队列实时显示每个文件的状态、页数、耗时;

右边同步预览识别结果 ------ Markdown 渲染效果、原始源码、原图,

三个视图随时切换对照,识别得对不对一眼就知道。

◆ 输 出 即 用

结果与源文件同名,可选保持原有目录层级;

PDF 可整本合并成一个 .md,也可以每页单独成文件。

◆ 界 面 顺 手

拖拽添加、深色 / 浅色主题一键切换、参数改完自动记住。

所有识别参数都在「参数设置」页里,带说明,不用查文档。

适合谁用

· 需要把纸质 / 扫描资料数字化归档的人

· 整理论文、教材、技术手册的研究者与学生

· 处理合同、发票、报表的财务与法务

· 给知识库 / RAG 准备高质量 Markdown 语料的开发者

· 任何受够了「复制 PDF 结果全是乱码」的人

OvisOCR2批量PDF、图片文档识别工具下载链接:

下载链接:https://pan.quark.cn/s/80cbf7006e9f

解压密码: aibbs.fun

相关推荐
慧都小妮子4 小时前
DevExpress Java 文档处理 API 免费 CTP:PDF、PowerPoint、条码与跨平台部署
java·pdf·powerpoint·devexpress·文档处理·条码生成
SamChan905 小时前
大文件多语言PDF翻译性能实测:300页文档的耗时、内存占用与失败率分析
python·ai·pdf·机器翻译
染的人5 小时前
Java 10x15cm面单PDF转换A4格式PDF
java·开发语言·pdf
2601_9677607817 小时前
2026年PDF压缩与页码添加工具技术实测:性能、算法与本地化适配深度对比
算法·pdf
weixin_450813531 天前
pdf文档转为markdown文档
linux·pdf
慧都小妮子1 天前
用 Python 批量把 PDF 参考文献排成 MLA 格式:Spire.Doc for Python 实战
python·pdf·c#·spire.doc·mla格式·参考文献排版·pdf批量处理
weixin_493503671 天前
商会系统里的在线文件预览:PDF/Word/Excel 三种实现与选型(Node + 前端实战)
pdf·word·excel
ygwelcome1 天前
视频收割机-VideoHarvester架构功能介绍
pdf·音视频
2601_967760781 天前
PDF转图片分辨率怎么选?几款工具实测
pdf
runningshark1 天前
Lecture: Simple Present vs Present Continuous PDF
pdf