OCR — 图片 OCR 识别与智能匹配工具

OCR --- 图片 OCR 识别与智能匹配工具

简洁版网页工具,支持将两组图片(A 为模板、B 为待重命名)进行 OCR 识别、智能匹配与一键下载重命名结果。


功能概览

  • 文件导入: A/B 两组各自选择或拖拽导入,支持多次追加与单张删除。
  • OCR 识别: 仅识别未识别/失败项;并发度 2;内置全局 QPS 限制(默认 2,可调 1--10)与网络/限流重试。
  • 智能匹配与重命名 :
    • 仅匹配与 A 尺寸一致的 B;
    • 文本相似度≥阈值(0--1,默认 0.5)才算匹配;
    • 支持手动匹配与冲突处理(同名冲突会回退冲突 B 并标记 unmatched)。
  • 下载: 批量单张下载或打包 ZIP 下载。
  • 可视化: 网格预览、OCR 文本、分辨率、匹配状态、统计面板与大图预览。

目录结构

  • index.html:当前主版本(推荐)。
  • ocrplus.html:旧版增强页面(保留,仅作备用)。
  • image.pngindex.html 截图。
  • ocrplus.pngocrplus.html 截图。
  • LICENSE:MIT 许可。

快速开始

  1. 准备后端(本地 Node 代理,转发到百度 OCR):
powershell 复制代码
node server.js
  • 默认地址:http://localhost:3000/ocr(或 http://0.0.0.0:3000/ocr)。
  • server.js 内配置你的百度 OCR API Key(每个账户有免费额度)。
  1. 打开前端:
  • 直接双击 index.html 用浏览器打开。
  • 按页面提示导入 A/B 两组图片,点击"开始识别并自动匹配"。
  1. 可选:下载结果
  • 使用"批量单张下载"或"批量 ZIP 下载"。

API 说明(代理服务)

  • POST /ocr
    • Request

      json 复制代码
      { "imageBase64": "..." }
    • Response(示例)

      json 复制代码
      { "words_result": [ { "words": "...", "probability": 0.9 } ] }

注意:API Key 为私密信息,请勿提交到公共仓库。


旧版 OCRPlus(保留说明)

ocrplus.html 为早期的增强版页面,包含"格式转换与下载"整套流程:

主要差异:

  • 增加了格式转换面板(JPG/PNG/WebP/AVIF/ICO 等,质量可调,重命名规则可选)。
  • OCR 流程以顺序进度条呈现;不包含主版的阈值/QPS滑块。
  • 手动匹配同样要求尺寸一致;提供结果列表与 ZIP 打包下载。

该页面已停止日常维护,建议优先使用 index.html 主版。


常见问题(FAQ)

  • 无法识别/报 QPS 限制?
    • 稍等片刻自动重试;或在主版页面降低 QPS 滑块值。
  • 相似度阈值怎么调?
    • 识别完成后可拖动滑块,系统会保留手动匹配并重新计算自动匹配。
  • 一张 A 被多个 B 匹配怎么办?
    • 内置去重策略:同名冲突时会回退冲突 B,并给出提示。

github

链接地址 https://github.com/regtet/OCR

许可证

本项目使用 MIT License,详见 LICENSE

相关推荐
weixin_4080996710 小时前
OCR 识别率提升实战:模糊 / 倾斜 / 反光图片全套优化方案(附 Python / Java / PHP 代码)
图像处理·人工智能·后端·python·ocr·api·抠图
weixin_4080996710 小时前
【实战教程】懒人精灵如何实现 OCR 文字识别?接口调用完整指南(附可运行示例)
java·前端·人工智能·后端·ocr·api·懒人精灵
蓦然乍醒10 小时前
零成本实现文档智能:本地化 OCR 提取与 AI 处理全流程实战
人工智能·ocr
P-surp10 小时前
tesseract ocr 文字识别
ocr
AI人工智能+11 小时前
药品经营许可证识别技术:通过图像预处理、目标检测、序列识别和版面分析,实现对药品经营许可证关键信息的高精度提取
深度学习·计算机视觉·ocr·药品经营许可证识别
weixin_4080996712 小时前
【保姆级教程】易语言调用 OCR 文字识别 API(从0到1完整实战 + 示例源码)
图像处理·人工智能·后端·ocr·api·文字识别·易语言
weixin_4080996712 小时前
【保姆级教程】按键精灵调用 OCR 文字识别 API(从0到1完整实战 + 可运行脚本)
java·前端·人工智能·后端·ocr·api·按键精灵
小女孩真可爱13 小时前
paddleocr使用50显卡训练报错
人工智能·ocr
AI人工智能+1 天前
基于高精度身份证OCR识别、炫彩活体检测及人脸比对技术的人脸核身系统,为通信行业数字化转型提供了坚实的安全底座
人工智能·计算机视觉·人脸识别·ocr·人脸核身
AI人工智能+1 天前
一种以深度学习与计算机视觉技术为核心的表格识别系统,实现了结构化、半结构化表格的精准文字提取、布局解析与版面完整还原
深度学习·计算机视觉·ocr·表格识别