【Week-Y4】修改yolov5s中C3模块的结构,common.py文件解读

修改C3模块的结构

如左图,有3个conv模块,需要改为右图,右图只包含2个conv模块。
📕提示:仅需修改./models/common.py文件

📕步骤:

(1)首先找到coomon.py中定义C3模块的地方;

(2)然后将代码与上图的左图对应起来,观察需要改动的位置,结合结构,更容易看懂代码;

(3)找到之后按照要求修改,并运行train.py,看是否能跑通。

./models/common.py中,保存的是v5s各个模块的实现,包括基本模块(如autopad、Conv、Bottleneck、BottleneckCSP、C3、SPP、Concat、Expand和Contract)和重要模块(NMS、AutoShape、Detections、Classify)。

一、commom.py文件解析

yolov5-master的文件结构如下:

python 复制代码
yolov5-master
|-classify
|-data
|-models (本次学习需要的文件在这里面)
	|-hub
	|-segment
	|-common.py(这是本次学习需要修改的文件,文件内容是yolov5s各个模块的定义)
	|-experi,emtal.py
	|-tf.py
	...
|-runs
|-segment
|-utils
...

打开common.py文件,找到定义C3模块的位置:

python 复制代码
class C3(nn.Module):
    # CSP Bottleneck with 3 convolutions
    def __init__(self, c1, c2, n=1, shortcut=True, g=1, e=0.5):
        """Initializes C3 module with options for channel count, bottleneck repetition, shortcut usage, group
        convolutions, and expansion.
        """
        super().__init__()
        c_ = int(c2 * e)  # hidden channels
        self.cv1 = Conv(c1, c_, 1, 1)
        self.cv2 = Conv(c1, c_, 1, 1)
        self.cv3 = Conv(2 * c_, c2, 1)  # optional act=FReLU(c2)
        self.m = nn.Sequential(*(Bottleneck(c_, c_, shortcut, g, e=1.0) for _ in range(n)))

    def forward(self, x):
        """Performs forward propagation using concatenated outputs from two convolutions and a Bottleneck sequence."""
        return self.cv3(torch.cat((self.m(self.cv1(x)), self.cv2(x)), 1))

这一段代码中定义了C3的模块结构,初始化时定义了3个卷积结构,然后在forward函数内部,给出了该模块的返回值,将返回值self.cv3(torch.cat((self.m(self.cv1(x)), self.cv2(x)), 1))拆解,并与给出的C3结构一一对应,得到下图:

由此可知,去掉concat后的卷积只需要将返回值的最外层丢掉即可。

二、修改代码,运行train.py训练

C3模块修改如下:【注释的那行是原来的结构,也就是concat后还经过了conv】

数据集:水果数据集 【使用week Y2的数据集】

命令行:python .\train.py --img 900 --batch 2 --epoch 100 --data .\fruit.yaml --cfg .\models\yolov5s.yaml --weights .\yolov5s.pt --device cpu【与week Y2的训练命令是一样的】

开始训练:

相关推荐
盼小辉丶13 分钟前
PyTorch强化学习实战——融合人类示范数据的高效强化学习
人工智能·pytorch·python·深度学习·强化学习
DM今天肝到几点?33 分钟前
GPT-6 Astra 发布:ARC-AGI-3 从 7.8% 跳到 99.9%,OpenAI 宣告「欢迎进入 AGI 时代」
人工智能·gpt·深度学习·agi
阳明山水2 小时前
销量预测2025—2026:从模型竞赛到系统融合的范式转型
人工智能·深度学习·算法·机器学习·架构
克里斯蒂亚诺更新2 小时前
Transformer(注意力机制)不按顺序-全盘扫描
人工智能·深度学习·transformer
147API2 小时前
蒸馏项目什么时候该停,怎样切换到RAG、微调或模型路由
人工智能·深度学习·机器学习·数据挖掘
YOLO视觉与编程3 小时前
YOLO / Labelme目标分割数据集增强扩充软件v1.0.0适用于YOLO全版本
人工智能·深度学习·yolo·计算机视觉
茗鹤APS和MES3 小时前
工业排产:AI可赋能,APS不可替代
人工智能·深度学习·机器学习
程序猿编码4 小时前
基于GGML的C++17轻量化语音推理引擎:说话人识别与语音分析技术全解析
开发语言·c++·pytorch·深度学习·神经网络·大模型
jay神5 小时前
深度学习如何确定Batch Size的大小?
人工智能·深度学习·计算机视觉·毕业设计·课程设计·batch
AI人工智能+5 小时前
证件阅读机,通过光学扫描、AI大脑、芯片感应三双“眼睛”协同工作,借助深度学习OCR引擎完成证卡识别与结构化输出
深度学习·ocr·智能硬件·证件阅读机