什么是照片类型知识库?
照片类型知识库是百数知识库里专门存放图片类资料的类型:产品实拍图、设备图纸、系统截图、报错截图、凭证照片、纸质手册拍照件都可以传上来。系统会对每张图做两件事------OCR 识别图里的文字,再把画面内容和标注一起向量化建索引;用户用大白话描述现象时,智能体就能召回对应的图片素材来回答。
哪些资料适合放照片知识库?
| 资料类型 | 举例 | 为什么必须走照片知识库 |
|---|---|---|
| 报错截图 | 系统弹窗、红屏错误、报错日志截图 | 文字版没记录,只能靠截图复现 |
| UI/操作截图 | 后台界面长什么样、按钮在哪 | 用户描述现象,召回对应截图 |
| 纸质资料拍照 | 纸质手册、合格证、现场单据 | 没有电子版,拍照即入库 |
| 产品实拍/图纸 | 设备外观、零件图、安装图 | 图里的文字和型号要被检索到 |
功能说明
照片类型知识库适用于图片类资料,例如产品实拍图、设备图纸、流程截图、凭证照片、手册插图等,支持上传图片文件创建知识库。
系统将对图片执行 OCR 文字识别与内容向量化处理,提取图片内的文字、画面特征并建立索引。
智能体可识别图片中的文字信息,支持基于图片内容进行检索与问答。
支持批量上传多张图片,图片入库后可查看图片详情,校验识别结果是否符合预期。
说明:图片内文字清晰度会影响 OCR 识别准确率;图片知识库不支持追加表格类结构化数据。
怎么让 OCR 识别得更准?
-
图片要清晰、对焦准、光线均匀,避免反光、模糊、倾斜;
-
文字尽量占满画面,不要只拍一角;截图时把对话框完整截下来;
-
手写体、艺术字、极小字号识别率会下降,这种图建议补一句人工标注;
-
入库后一定要进「查看知识库数据」核对 OCR 结果,识别错的文字会直接导致检索跑偏。
创建流程
创建照片类型知识库,进入知识库详情页,添加内容。

具体步骤如下:
1)上传图片:选择本地图片文件,支持单张或批量上传多张图片。

2)标注设置
- 智能标注:系统基于图片画面与 OCR 识别出的文字,自动生成图片的标签与描述信息,无需人工手动填写标注内容。
- 人工标注:用户手动录入标签与描述信息,补充图片的业务背景、补充说明等 OCR 无法识别的内容。
智能标注 vs 人工标注怎么选?
| 对比项 | 智能标注 | 人工标注 |
|---|---|---|
| 谁来写标签/描述 | 系统根据画面和 OCR 自动生成 | 用户手动录入 |
| 优点 | 快、零成本,批量上传时省事 | 能补充业务背景,OCR 看不见的也能写 |
| 局限 | 只能描述图里看得见的内容 | 费人工,适合重要图片 |
| 建议 | 普通截图先用智能标注 | 关键图/易混淆图在智能标注基础上人工补一句 |

3)数据处理
系统读取原图、OCR 识别文字以及标注信息(智能标注 / 人工标注),统一进行向量化并构建检索索引。处理完成后,图片资源、识别文本、标注信息正式入库,智能体即可基于图片内容进行检索和问答。

4)查看知识库数据
数据处理完成后,可进入图片知识库查看全部入库数据。支持浏览原图、查看 OCR 识别提取的文字内容以及人工 / 智能标注信息,核对图片完整性、文字识别效果与标注内容,校验入库结果是否符合预期。

常见问题 FAQ
Q1:照片知识库和文本知识库有什么区别?
A:文本知识库收的是已经电子化的文字;照片知识库收的是图片,靠 OCR 把图里的文字读出来再检索。纸质资料、截图没有电子版,只能走照片库。
Q2:为什么我描述了现象,却召回不到对应的截图?
A:按顺序查------① OCR 是否把图里关键文字识别对了;② 是否补了人工标注(OCR 看不见业务上下文);③ 图片本身是否清晰;④ 试试用图里出现的关键词搜,而不是凭印象描述。
Q3:一张图能同时被 OCR 和视觉特征检索到吗?
A:可以。系统既索引 OCR 出来的文字,也索引画面特征和标注;用户按文字、按画面描述都可能命中。
Q4:照片知识库里能放 Excel 表格截图吗?
A:能放,但如果是结构化数据要查询统计,建议把表格内容单独做成表格知识库;截图走照片库只适合「给人看一眼」的场景。
Q5:智能标注不准怎么办?
A:在智能标注基础上补人工标注,把业务背景、零件编号、错误含义写进去;这是提升召回最有效的一步。
Q6:支持批量上传吗?
A:支持。批量上传时建议先用智能标注跑一遍,再逐张核对关键图的 OCR 和标注。
上线前检查清单
□ 图片是否清晰、对焦准确、关键文字完整?
□ 关键图片是否补了人工标注,写清业务背景?
□ 是否进「查看知识库数据」核对过 OCR 识别结果?
□ 结构化数据是否误传到了照片库(应走表格知识库)?
核心概念术语表
| 术语 | 一句话解释 |
|---|---|
| 照片知识库 | 存放图片类资料的知识库,靠 OCR 和视觉特征检索 |
| OCR | 光学字符识别,把图片里的文字读成可检索文本 |
| 智能标注 | 系统自动根据画面和 OCR 生成图片标签/描述 |
| 人工标注 | 手动补充图片的业务背景,弥补 OCR 看不见的内容 |
| 向量化 | 把图片文字和标注转成向量,供语义检索 |
| 召回 | 根据用户问题从知识库里找出最相关的图片 |
元信息
适用产品:百数AI 知识库 / 照片格式|能力:OCR 文字识别、智能/人工标注、图片内容向量化检索|文档更新时间:2026-09