[数据集][目标检测]文本表格检测数据集VOC+YOLO格式6688张5类别

数据集格式:Pascal VOC格式+YOLO格式(不包含分割路径的txt文件,仅仅包含jpg图片以及对应的VOC格式xml文件和yolo格式txt文件)

图片数量(jpg文件个数):6688

标注数量(xml文件个数):6688

标注数量(txt文件个数):6688

标注类别数:5

标注类别名称:"figure","list","table","text","title"

每个类别标注的框数:

figure 框数 = 3388

list 框数 = 1671

table 框数 = 1855

text 框数 = 45018

title 框数 = 10497

总框数:62429

使用标注工具:labelImg

标注规则:对类别进行画矩形框

重要说明:暂无

特别声明:本数据集不对训练的模型或者权重文件精度作任何保证,数据集只提供准确且合理标注

图片预览:

标注例子:

下载地址:https://download.csdn.net/download/FL1623863129/89769330

相关推荐
LaughingZhu17 分钟前
Product Hunt 每日热榜 | 2026-09-12
人工智能·深度学习·神经网络·搜索引擎·百度
Zguigo29 分钟前
【CUDA1】GPUvsCPU,CUDA Kernel
人工智能·pytorch·深度学习
thesky12345633 分钟前
用 ONNX Runtime 把 PyTorch 模型变成跨平台极速推理引擎:导出、优化、量化完整实
人工智能·深度学习·模型部署
猎头南楼5 小时前
大模型后训练与 Agent 自迭代:两类工程能力的观察
人工智能·深度学习·机器学习
Zzj_tju5 小时前
CLIP 图文对齐:先核对正样本,再相信检索分数
人工智能·深度学习·语言模型·自然语言处理
千里码aicood6 小时前
基于深度学习的驾驶员分心驾驶行为识别研究
人工智能·深度学习
Zzj_tju7 小时前
VLM 读图评测:先审计评分器,再判断读错还是算错
人工智能·深度学习·机器学习·语言模型
差不多的周周7 小时前
《HuMoCon:人类运动理解的概念发现》论文核心部分详解
人工智能·深度学习·计算机视觉·自然语言处理
tyler_download8 小时前
揉扁搓圆transformer架构:NAG优化器算法详解
深度学习·算法·transformer
Jared_devin9 小时前
单头、多头 Self-Attention可视化
人工智能·pytorch·深度学习·算法·机器学习·pycharm