技术栈
动手RAG: ocr调研
YueTann
2024-07-08 18:14
对于rag应用来说,文档是第一步,对于部分扫描件的文件来讲,主要就需要OCR.
OCR
tesseract
ppocr
mmocr
还有诸如
chineseocr_lite
darknet-ocr
https://blog.csdn.net/CHYabc123456hh/article/details/107846268
easyocr
OCR包含几类,
自然场景中的文字识别,文档中的文字识别
pipeline: 文本检测,文本识别,文档结构化识别(版面分析,表格识别,关键信息提取)
表格识别
部署
pdf解析
文档解析
参考
https://github.com/PaddleOCR-Community/Dive-into-OCR/blob/main/notebook_ch/1.introduction/OCR技术导论.ipynb
ocr
上一篇:
深度学习2 线性回归和非线性回归
下一篇:
深度学习1
相关推荐
万物皆智能
17 小时前
12个图片转文字软件,包括OCR识别等功能
ocr
跨境数据猎手
1 天前
ddddocr 与多模态大模型 OCR 对比和选择建议
ocr
AI人工智能+
2 天前
医疗机构执业许可证识别技术融合计算机视觉、OCR与大模型,实现手机拍照或上传文件后自动提取证书关键字段信息
深度学习
·
自然语言处理
·
ocr
·
医疗机构执业许可证识别
开开心心就好
3 天前
以图搜图找重复图片,本地工具离线就能用
javascript
·
智能手机
·
ffmpeg
·
c#
·
ocr
·
word
·
音视频
格数致用
4 天前
1.5 扫描件浅色斜铺文字水印:像素级 OCR 验证与掩膜修复
ocr
·
水印识别
楚识科技
4 天前
移动端OCR SDK实战接入:实现身份证/银行卡离线识别全流程
ocr
海宇数据
5 天前
零信任架构实战:基于海宇身份证OCR构建自动化证照采集网关
人工智能
·
架构
·
自动化
·
ocr
开开心心就好
5 天前
图片白底怎么去掉?抠图工具抠完背景透明
java
·
服务器
·
开发语言
·
pdf
·
ocr
·
散列表
·
启发式算法
AI人工智能+
5 天前
行驶证识别技术融合计算机视觉与自然语言处理,实现对模糊、倾斜、反光等复杂场景下行驶证的高精度结构化数据提取
人工智能
·
深度学习
·
自然语言处理
·
ocr
·
行驶证识别
开开心心就好
6 天前
超市定时播音软件,免费版支持循环播放
智能手机
·
ffmpeg
·
ocr
·
word
·
vim
·
音视频
·
visual studio
热门推荐
01
如何新建文件夹? 电脑新建文件夹的4种方法
02
国内可直接用、免费额度/永久免费的大模型API清单(含 SiliconFlow、火山、阿里、智谱、百度、Kimi、DeepSeek、DMXAPI 等)
03
历年考研数学一、数学二、数学三真题试卷及答案PDF
04
GitHub 镜像站点
05
Telegram APK 下载安装完整指南 — 2026年最新
06
蜘蛛磁力 搜索引擎大全,如何使用蜘蛛磁力查找磁力链接
07
微信历史版本含下载地址( Windows PC | 安卓 | MAC )及设置微信不更新
08
Windows 10/11 如何退出微软账户并改用本地账户登录(含找不到选项的解决方法)
09
2026 爱知・名古屋亚运会怎么看?直播平台+赛程安排分享
10
给AI一张“业务概念地图“:本体如何从哲学走向企业智能