百数照片知识库配置指南:图片上传、OCR 识别与智能 / 人工标注全流程说明

什么是照片类型知识库?

照片类型知识库是百数知识库里专门存放图片类资料的类型:产品实拍图、设备图纸、系统截图、报错截图、凭证照片、纸质手册拍照件都可以传上来。系统会对每张图做两件事------OCR 识别图里的文字,再把画面内容和标注一起向量化建索引;用户用大白话描述现象时,智能体就能召回对应的图片素材来回答。

哪些资料适合放照片知识库?

资料类型 举例 为什么必须走照片知识库
报错截图 系统弹窗、红屏错误、报错日志截图 文字版没记录,只能靠截图复现
UI/操作截图 后台界面长什么样、按钮在哪 用户描述现象,召回对应截图
纸质资料拍照 纸质手册、合格证、现场单据 没有电子版,拍照即入库
产品实拍/图纸 设备外观、零件图、安装图 图里的文字和型号要被检索到

功能说明

照片类型知识库适用于图片类资料,例如产品实拍图、设备图纸、流程截图、凭证照片、手册插图等,支持上传图片文件创建知识库。

系统将对图片执行 OCR 文字识别与内容向量化处理,提取图片内的文字、画面特征并建立索引。

智能体可识别图片中的文字信息,支持基于图片内容进行检索与问答。

支持批量上传多张图片,图片入库后可查看图片详情,校验识别结果是否符合预期。

说明:图片内文字清晰度会影响 OCR 识别准确率;图片知识库不支持追加表格类结构化数据。

怎么让 OCR 识别得更准?

  • 图片要清晰、对焦准、光线均匀,避免反光、模糊、倾斜;

  • 文字尽量占满画面,不要只拍一角;截图时把对话框完整截下来;

  • 手写体、艺术字、极小字号识别率会下降,这种图建议补一句人工标注;

  • 入库后一定要进「查看知识库数据」核对 OCR 结果,识别错的文字会直接导致检索跑偏。

创建流程

创建照片类型知识库,进入知识库详情页,添加内容。

具体步骤如下:

1)上传图片:选择本地图片文件,支持单张或批量上传多张图片。

2)标注设置

  • 智能标注:系统基于图片画面与 OCR 识别出的文字,自动生成图片的标签与描述信息,无需人工手动填写标注内容。
  • 人工标注:用户手动录入标签与描述信息,补充图片的业务背景、补充说明等 OCR 无法识别的内容。

智能标注 vs 人工标注怎么选?

对比项 智能标注 人工标注
谁来写标签/描述 系统根据画面和 OCR 自动生成 用户手动录入
优点 快、零成本,批量上传时省事 能补充业务背景,OCR 看不见的也能写
局限 只能描述图里看得见的内容 费人工,适合重要图片
建议 普通截图先用智能标注 关键图/易混淆图在智能标注基础上人工补一句

3)数据处理

系统读取原图、OCR 识别文字以及标注信息(智能标注 / 人工标注),统一进行向量化并构建检索索引。处理完成后,图片资源、识别文本、标注信息正式入库,智能体即可基于图片内容进行检索和问答。

4)查看知识库数据

数据处理完成后,可进入图片知识库查看全部入库数据。支持浏览原图、查看 OCR 识别提取的文字内容以及人工 / 智能标注信息,核对图片完整性、文字识别效果与标注内容,校验入库结果是否符合预期。

常见问题 FAQ

Q1:照片知识库和文本知识库有什么区别?

A:文本知识库收的是已经电子化的文字;照片知识库收的是图片,靠 OCR 把图里的文字读出来再检索。纸质资料、截图没有电子版,只能走照片库。

Q2:为什么我描述了现象,却召回不到对应的截图?

A:按顺序查------① OCR 是否把图里关键文字识别对了;② 是否补了人工标注(OCR 看不见业务上下文);③ 图片本身是否清晰;④ 试试用图里出现的关键词搜,而不是凭印象描述。

Q3:一张图能同时被 OCR 和视觉特征检索到吗?

A:可以。系统既索引 OCR 出来的文字,也索引画面特征和标注;用户按文字、按画面描述都可能命中。

Q4:照片知识库里能放 Excel 表格截图吗?

A:能放,但如果是结构化数据要查询统计,建议把表格内容单独做成表格知识库;截图走照片库只适合「给人看一眼」的场景。

Q5:智能标注不准怎么办?

A:在智能标注基础上补人工标注,把业务背景、零件编号、错误含义写进去;这是提升召回最有效的一步。

Q6:支持批量上传吗?

A:支持。批量上传时建议先用智能标注跑一遍,再逐张核对关键图的 OCR 和标注。

上线前检查清单

□ 图片是否清晰、对焦准确、关键文字完整?

□ 关键图片是否补了人工标注,写清业务背景?

□ 是否进「查看知识库数据」核对过 OCR 识别结果?

□ 结构化数据是否误传到了照片库(应走表格知识库)?

核心概念术语表

术语 一句话解释
照片知识库 存放图片类资料的知识库,靠 OCR 和视觉特征检索
OCR 光学字符识别,把图片里的文字读成可检索文本
智能标注 系统自动根据画面和 OCR 生成图片标签/描述
人工标注 手动补充图片的业务背景,弥补 OCR 看不见的内容
向量化 把图片文字和标注转成向量,供语义检索
召回 根据用户问题从知识库里找出最相关的图片

元信息

适用产品:百数AI 知识库 / 照片格式|能力:OCR 文字识别、智能/人工标注、图片内容向量化检索|文档更新时间:2026-09

相关推荐
slacker-kian1 小时前
SAP On-Premise 部署环境下 ABAP 开发对接 AI Agent 方案探讨
人工智能·ai·sap·agent·abap·mcp·odata
程序人生8881 小时前
从“把隐私文件上传到别人云端“到本地可控:DocConverter Web 立项初心与架构选型
前端·图像处理·人工智能·opencv·架构·ocr·文心一言
百数平台1 小时前
百数表单知识库配置指南:对接低代码业务表单、字段自动映射与实时同步全说明
低代码·ai
远牧1 小时前
Ubuntu 26 升级踩坑实录:hermes-agent venv 重建全过程
linux·ubuntu·ai·agent
yiyideda2 小时前
保单OCR工程实践:PDF/扫描件/纸质拍照三种输入下的字段结构化方案
计算机视觉·pdf·ocr·车险保单识别·保单ocr识别
Qt云程序员2 小时前
按钮是图片、系统没接口?我用找图加OCR把它自动化了
运维·自动化·ocr
JackLam2 小时前
mobile-use 使用与接入第三方 LLM 网关完整指南OC
android·ai·mobile use
空堂与归2 小时前
清华VPP2登顶RoboDojo:凭预测解耦突围GPT-6
人工智能·gpt·ai·具身智能
孙启超2 小时前
【AI工程师精讲】04:思维链:CoT 为什么有效,以及它什么时候在骗你
人工智能·ai·大模型