YOLOv10(1):初探,训练自己的数据

目录

[1. 写在前面](#1. 写在前面)

[2. 值得关注的点](#2. 值得关注的点)

[3. 训练自己的数据集](#3. 训练自己的数据集)

[4. 阅读代码的小建议](#4. 阅读代码的小建议)


1. 写在前面

很多人YOLOv9还没有完全研究透,YOLOv10出来了。

惊不惊喜,意不意外!

据论文里提到,YOLOv10就是为了加速推理,在保证精度的同时,降低参数量,减小计算量。就冲这,还没有研究YOLOv9的同学们,直接跳过吧。

先说一句,如果大家不想动手,请不要客气,直接找我拿改动过的代码。

2. 值得关注的点

论文提到,YOLOv10的研究团队为 YOLO 提出了整体效率 - 准确率驱动的模型设计策略,从效率和准确率两个角度全面优化 YOLO 的各个组件,大大降低了计算开销并增强了模型能力。研究过ELAN的同学有没有似曾相识的感觉,通过预设某种策略来设计网络,听上去和理解上去都很玄学,但是,对于我们这种本着用好就可以的同学,有用就是硬道理。

此外,通过大量实验表明,YOLOv10 在各种模型规模上都实现了 SOTA 性能和效率。例如,YOLOv10-S 在 COCO 上的类似 AP 下比 RT-DETR-R18 快 1.8 倍,同时参数数量和 FLOP 大幅减少。与 YOLOv9-C 相比,在性能相同的情况下,YOLOv10-B 的延迟减少了 46%,参数减少了 25%。再一次划重点,可以先跨过YOLOv9,直接开搞YOLOv10。

通过消除NMS 的依赖性,通过利用空间通道解耦下采样 和排序指导的模块设计优化模型架构设计,YOLOv10在实时端到端目标检测领域具有重要意义。

3. 训练自己的数据集

(1)构造训练集

YOLOv10所需要的训练数据集制式和YOLOv8、YOLOv9都是一样的,因此只要构建过YOLOv8、YOLOv9训练数据集的同学应该不会感觉到难。

如果有对数据集制作有疑问的同学,可以私信我。

(2)做一些微小的改动

YOLOv10的训练工作在开头的时候有些难,尤其是如果大家在README.md文件中看到如下内容的时候。

不要担心,你只需要改动几个文件的几行代码,就可以以更轻松、更优雅的姿势开启训练。

第一步,修改配置文件

修改ultralytics\cfg\default.yaml文件,设置好model和data,如下所示。

第二步,添加训练入口

在ultralytics\models\yolov10\train.py文件中添加训练入口,具体的就是构建一个YOLOv10DetectionTrainer,然后开始训练。具体代码参考如下。

请注意,以下图中有两点需要注意。

M0:添加路径;

M1:添加训练入口;

第三步,开始训练吧

进入./yolov10-main/ultralytics/models/yolov10路径。

执行python3 train.py开始训练吧。

4. 阅读代码的小建议

YOLOv10和YOLOv8的代码结构略有相似。

我们将整个代码结构划分为三条线,分别是Trainer、Model和YOLO。其实Model线和YOLO线是一样的,都是构建模型相关的东西。Trainer则是构建训练相关的内容。

Trainer的继承关系

BaseTrainer - > DetectionTrainer -> YOLOv10DetectionTrainer

通过实例化YOLOv10DetectionTrainer,来构建整体的训练脉络。

Model的继承关系

task.py: BaseModel(nn.Module)

task.py: DetectionModel(BaseModel)

task.py: YOLOv10DetectionModel(DetectionModel)

YOLO的继承关系

engine/model.py: class Model(nn.Module)

yolo/model.py: class YOLO(Model)

yolov10/model.py: class YOLOv10(YOLO)

在YOLOv10DetectionTrainer中重载了get_model接口,用来实例化一个YOLOv10DetectionModel对象,开启训练。

相关推荐
黑妹天下第一乖10 分钟前
第 05 讲:阿加犀 AidCV 图像处理加速与 OpenCV 一致开发实战
开发语言·图像处理·人工智能·嵌入式硬件·数码相机·opencv·计算机视觉
YOLO数据集集合1 小时前
无人机视角工程机械目标检测数据集 | 工程机械检测 无人机航拍 智慧工地9152期
人工智能·yolo·目标检测·计算机视觉·语言模型·无人机·工程车
闭包不眠1 小时前
PDF文字提取交付前该检查什么
运维·服务器·图像处理·人工智能·计算机视觉·pdf
Latchh2 小时前
PDF提取到文字后怎样发现乱码
图像处理·人工智能·计算机视觉·pdf
YOLO数据集集合2 小时前
空中目标检测数据集 | 空中目标检测 无人机识别 鸟类检测 低空安防 反无人机数据集 鸟类 直升机9154期
人工智能·目标检测·计算机视觉·无人机·空中目标·反无人机
这张生成的图像能检测吗19 小时前
(论文速读)LLSA:把 DiT 稀疏注意力从二次复杂度降到对数线性
计算机视觉·注意力机制·图像生成
Mark White21 小时前
ICCV 2019【从颜色科学到相机】01_为什么照片不是光照测量
计算机视觉
指针向南1 天前
canvas最大尺寸是多少:三个浏览器能画、能导出的上限
图像处理·人工智能·计算机视觉
hahaha60161 天前
黑体轨迹和色温--光源白点
人工智能·嵌入式硬件·算法·计算机视觉
昨日之日20061 天前
Visual Enhancer:一键让模糊照片视频变清晰,升分辨率、插帧、转HDR,一键搞定素材修复
计算机视觉·音视频