带标注的成熟棉花识别数据集,识别率83.9%数据集,505张图,支持yolo,coco json,voc xml,文末有模型训练代码

这是一个高质量的成熟棉花识别数据集,包含1505张带标注的图像,在测试中达到了83.9%的识别率。数据集支持YOLO系列模型(包括YOLOv7/v8/v9/v11/v12/v26)、COCO JSON和PASCAL VOC XML格式,文末还提供了完整的模型训练代码。

模型训练指标参数:

模型训练图:

数据集拆分

本数据集共包含1505张图像,按照机器学习标准流程进行划分:

训练集:1220张图像,用于模型学习棉花不同生长阶段的特征,适用于农业科研、智能农业监测等场景。

验证集

验证集:224张图像,用于在训练过程中调整超参数和防止过拟合,确保模型在未知数据上的泛化能力。

测试集

测试集:61张图像,用于最终评估模型性能,模拟真实农业监测环境中的识别效果。

预处理

自动定向:应用

调整大小:拉伸到640x640

增强

数据集标签:

'Cotton Blossom', 'Cotton Bud', 'Matured Cotton Boll', 'Split Cotton Boll', 'Early Boll'

标签解释

Cotton Blossom

盛开棉花花 / 棉花盛花期花朵

释义:完全绽放的棉花花朵,处于授粉阶段。

Cotton Bud

棉蕾 / 棉花花苞

释义:尚未开放、包裹紧实的棉花幼小花蕾,开花前阶段。

Early Boll

幼龄棉铃 / 早期棉桃

释义:授粉完成后刚发育成型、体积偏小的嫩棉桃,未成熟。

Matured Cotton Boll

成熟棉铃

释义:完全发育成熟,但外壳完整闭合、没有开裂的棉桃。

Split Cotton Boll

开裂棉铃

释义:成熟后果壳自动裂开、内部棉絮外露的棉桃。

数据集图片和标注信息示例:

数据集下载:

yolo26,yolo v12,yolo v11,yolo v9,yolo v8,yolo v7,coco json,pascal voc xml:

https://download.csdn.net/download/pbymw8iwm/93170623

YOLO模型训练

下载数据集之后解压到当前文件夹,然后将 我的仓库 https://gitcode.com/pbymw8iwm/YOLOProject 里的训练模型脚本复制到文件夹下,假设你使用的是yolov8来训练你就用python train_yolov8.py

​​

模糊图片在模型训练中的优势分析

该数据集中包含了如果包含了一些模糊图片,这并非数据缺陷,而是一种精心设计的数据增强策略,能为模型训练带来以下显著优势:

  1. 提升模型鲁棒性:现实场景中,可能发生在运动模糊,对焦不准或光线不足的情况下。在训练集中引入模糊样本,可以迫使模型学习更本质的特征,而不是过度依赖清晰的边缘或纹理细节,从而提升模型在复杂、非理想成像条件下的识别能力。
  2. 模拟真实世界噪声:监控摄像头、手机等设备在低光照或快速移动时极易产生模糊。包含此类图片的数据集能让模型提前"见识"并适应这种噪声,减少在实际部署时因图像质量下降而导致的性能骤降。
  3. 防止模型过拟合 :如果训练集全是高清、摆拍的完美图片,模型容易记住这些特定场景下的"干净"特征,而对新的、稍有模糊的图片泛化能力差。模糊图片作为一种有效的正则化手段,可以增加数据分布的多样性,防止模型过拟合到有限的清晰样本上。
    总结 :因此,数据集中包含的模糊图片,与你看到的"水平翻转"、"剪切形变"、"随机遮挡"等增强操作一样,都是为了构建一个更接近真实世界复杂分布的数据环境,从而训练出更健壮、更泛化、更实用的模型。

模型验证测试情况:

验证测试代码:

python 复制代码
#需要安装pip install ultralytics
from ultralytics import YOLO
import cv2

# ===================== 1. 加载YOLO模型 =====================
# 自动下载预训练模型(yolov8n最轻量快速),也可换 yolov8s/m/l/x
model = YOLO("best.pt")
# ===================== 2. 推理配置 =====================
image_path = "326_jpg.rf.8ad64cc0668df32c4e5f59b50e899e9c.jpg"  # 你的图片路径
save_result = True       # 是否保存标注后的图
# ===================== 3. 执行推理 =====================
results = model.predict(
    source=image_path,
    conf=0.01,          # 置信度阈值(低于该值忽略)
    save=False,         # 关闭默认保存,自定义保存
    verbose=False       # 关闭冗余日志
)

# ===================== 4. 解析结果:目标区域 + 标注信息 =====================
print("="*50)
print("YOLO 推理结果(目标区域 + 标注信息)")
print("="*50)

# 获取图片(用于绘制框)
img = cv2.imread(image_path)

# 遍历所有检测目标
for idx, result in enumerate(results):
    boxes = result.boxes  # 所有检测框
    
    for box in boxes:
        # ========== 提取目标区域(坐标) ==========
        # xyxy: 左上角x, 左上角y, 右下角x, 右下角y
        x1, y1, x2, y2 = box.xyxy[0].cpu().numpy()
        # 宽高
        w = x2 - x1
        h = y2 - y1
        
        # ========== 提取标注信息 ==========
        cls_id = int(box.cls[0])          # 类别ID
        cls_name = model.names[cls_id]    # 类别名称
        conf = float(box.conf[0])         # 置信度
        
        # ========== 打印信息 ==========
        print(f"目标 {idx+1}:")
        print(f"  标注类别:{cls_name}")
        print(f"  置信度:{conf:.2f}")
        print(f"  目标区域坐标:")
        print(f"    左上角 ({x1:.1f}, {y1:.1f})")
        print(f"    右下角 ({x2:.1f}, {y2:.1f})")
        print(f"    宽×高:{w:.1f} × {h:.1f}")
        print("-"*30)
        
        # ========== 在图片上绘制检测框 ==========
        cv2.rectangle(img, (int(x1), int(y1)), (int(x2), int(y2)), (0, 255, 0), 2)
        cv2.putText(img, f"{cls_name} {conf:.2f}", 
                    (int(x1), int(y1)-10), 
                    cv2.FONT_HERSHEY_SIMPLEX, 0.5, (0, 255, 0), 2)

# ===================== 5. 保存/显示结果 =====================
if save_result:
    cv2.imwrite("yolo_result.jpg", img)
    print("✅ 标注图片已保存为:yolo_result.jpg")

# 显示图片(可选)
cv2.imshow("YOLO Result", img)
#cv2.waitKey(0)
#cv2.destroyAllWindows()
相关推荐
殷忆枫21 小时前
AI笔记三十七:AI边缘端道桥安全监测系统:YOLOv8n推理与Web监控全解析
笔记·yolo
探物 AI1 天前
yolo检测核心组件1:SE注意力机制 (Squeeze-and-Excitation)
yolo
꧁执笔小白꧂1 天前
详细pyenv+venv+pip安装ultralytics
yolo·venv·pyenv·ultralytics
AI小译1 天前
微调数据集(主流开源模型)
数据集
前网易架构师-高司机2 天前
带标注的细胞有丝分裂数据集数据集,识别率95.9%,304张图,支持yolo,coco json,voc xml,文末有模型训练代码
yolo·细胞·显微镜·生物·有丝分裂·显微
AI小译2 天前
ShareGPT 数据集格式
数据集·sharegpt
前网易架构师-高司机2 天前
带标注的移动通信基站信号塔,可识别塔架和塔身数据集,识别率93.5%,1008张图,支持yolo,coco json,voc xml,文末有模型训练代码
yolo·数据集·通信基站·信号塔·塔架·塔身
AI棒棒牛3 天前
第11讲 | 目标检测任务:边界框、IoU、类别与置信度
人工智能·yolo·目标检测·yolo26
深度研习笔记3 天前
OpenCV工业视觉实战06|ROI区域截取+局部精细化检测,锁定作业区域、屏蔽无效背景,大幅提升YOLO检测准确率
人工智能·opencv·yolo