手写ocr 算法合集

RapidOCR(最推荐替代 PaddleOCR,手写笔记 / 作业首选)

  • 架构:DB 检测 + CRNN 识别,PyTorch,支持 ONNX Runtime CPU 推理
  • 优势:中文手写实测漏检比 PaddleOCR 少,倾斜、不规整手写笔记、学生作业表现更好;Umi-OCR 内置引擎,开箱即用,可微调,支持输出坐标。
  • 缺点:重度草书识别差;版面分析弱。
  • 适合:需要检测框坐标、CPU 部署、手写笔记、试卷手写。

2. CnOCR(breezedeus)

  • 架构:DB/CTPN 检测 + CRNN 识别,自带中文手写预训练权重
  • 优势:API 简洁,原生支持手写中文,支持竖排;很方便用自己手写数据集做微调。
  • 缺点:社区较小,检测速度略慢于 RapidOCR。

1. GLM-OCR(智谱,0.9B,手写混排强,显存门槛低)

  • 亮点:专门文档 VLM,手写 + 印刷混排、表格、简单公式都能处理;最低 4GB 显存可跑;Apache2.0 可商用,输出 Markdown/JSON。
  • 适合:笔记、作业,手写印刷混排,不想折腾检测框调参。

2. 腾讯 HunyuanOCR(HyOCR,1B)

  • 亮点:端到端 OCR,消除两阶段误差传递;手写、表格、畸变拍照文档强,支持 vLLM 加速。
  • 适合:复杂文档手写,需要高吞吐推理。

3. MinerU

  • 亮点:试卷、笔记手写 + 表格 + 公式综合能力很强;常用来做 PDF / 图片文档解析,输出 markdown。
  • 注意:偏向文档解析,细粒度文字坐标输出不如传统 OCR 流水线。
相关推荐
楚识科技1 天前
合同比对全流程自动化:OCR识别+差异比对+法律风险字段抽取实战指南
运维·自动化·ocr
楚识科技2 天前
手写表格OCR接口接入全指南:实战调用与结构化字段解析
ocr
VidDown2 天前
从视频画面里提取文字:OCR、文字检测与结构化输出
python·网络协议·ocr·音视频·视频编解码·视频
一马平川的大草原2 天前
pdf转md的三种方式
pdf·ocr·md
zhoupenghui1682 天前
复杂PDF与扫描件解析存储实战:文本、图片OCR、表格识别及RAG向量入库全流程
pdf·ocr·复杂pdf解析
楚识科技9 天前
电力电网 OCR 落地实践:轻量级模型 CPU 推理与鲲鹏 + 昇腾信创适配
ocr
巡山小钻风来也11 天前
【保姆级教程】自定义数据集微调PP-OCRv6文本检测模型
python·ocr·paddlepaddle
山顶夕景12 天前
【文档解析】2026年技术发展和趋势
ocr·文档解析·agentic
楚识科技12 天前
云端 API 与私有化 OCR 的架构取舍:数据边界、并发模型与成本测算
ocr