YOLOv9中加入SCConv模块！

🕗 发布于 2024-03-01 12:10 YOLO 机器学习 深度学习 人工智能 pytorch

专栏介绍：YOLOv9改进系列 | 包含深度学习最新创新，主力高效涨点！！！

一、本文介绍

本文将一步步演示如何在YOLOv9中添加 / 替换新模块，寻找模型上的创新！

适用检测目标： YOLOv9模块通用改进

二、改进步骤

《YOLOv9: Learning What You Want to Learn Using Programmable Gradient Information》

论文地址： https://arxiv.org/abs/2402.13616

代码地址： https://github.com/WongKinYiu/yolov9

2.1 创建一个脚本存放新模块

为方便调用，这里我将脚本放在models包下，命名为extra.py。

2.2 将模块复制到脚本中，并导入需要的包（以SCConv为例）

我们将SCConv的代码复制到刚刚创建的extra.py脚本中。

import torch
import torch.nn as nn
import torch.nn.functional as F

from models.common import Conv


class SCConv(nn.Module):
    """https://github.com/MCG-NKU/SCNet/blob/master/scnet.py"""
    def __init__(self, inplanes, planes, stride=1, padding=1, dilation=1, groups=1, pooling_r=4):
        super(SCConv, self).__init__()
        self.k2 = nn.Sequential(
                    nn.AvgPool2d(kernel_size=pooling_r, stride=pooling_r),
                    Conv(inplanes, planes, k=3, s=1, p=padding, d=dilation, g=groups, act=False))
        self.k3 = Conv(inplanes, planes, k=3, s=1, p=padding, d=dilation, g=groups, act=False)

        self.k4 = Conv(inplanes, planes, k=3, s=1, p=padding, d=dilation, g=groups, act=False)

    def forward(self, x):
        identity = x

        out = torch.sigmoid(torch.add(identity, F.interpolate(self.k2(x), identity.size()[2:]))) # sigmoid(identity + k2)
        out = torch.mul(self.k3(x), out)    # k3 * sigmoid(identity + k2)
        out = self.k4(out)  # k4

        return out

2.3 对yolo.py操作

打开models包下的yolo.py文件夹，将刚才创建的脚本导入。并在下方第700行的位置(位置可能因v9版本更新变动)加入下方代码。

2.4 运行配置文件

创建模型配置文件（yaml文件），将我们所作改进加入到配置文件中（这一步的配置文件可以复制models - > detect 下的yaml修改。）。对YOLO系列yaml文件不熟悉的同学可以看我往期的yaml详解教学！

YOLO系列 “.yaml“文件解读-CSDN博客

# YOLOv9

# parameters
nc: 80  # number of classes
depth_multiple: 0.33  # model depth multiple
width_multiple: 0.25  # layer channel multiple
#activation: nn.LeakyReLU(0.1)
#activation: nn.ReLU()

# anchors
anchors: 3

# YOLOv9 backbone
backbone:
  [
   [-1, 1, Silence, []],  
   
   # conv down
   [-1, 1, Conv, [64, 3, 2]],  # 1-P1/2

   # conv down
   [-1, 1, Conv, [128, 3, 2]],  # 2-P2/4

   # elan-1 block
   [-1, 1, RepNCSPELAN4, [256, 128, 64, 1]],  # 3

   # avg-conv down
   [-1, 1, ADown, [256]],  # 4-P3/8

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 256, 128, 1]],  # 5

   # avg-conv down
   [-1, 1, ADown, [512]],  # 6-P4/16

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 512, 256, 1]],  # 7

   # avg-conv down
   [-1, 1, ADown, [512]],  # 8-P5/32

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 512, 256, 1]],  # 9
  ]

# YOLOv9 head
head:
  [
   # elan-spp block
   [-1, 1, SPPELAN, [512, 256]],  # 10

   # up-concat merge
   [-1, 1, nn.Upsample, [None, 2, 'nearest']],
   [[-1, 7], 1, Concat, [1]],  # cat backbone P4

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 512, 256, 1]],  # 13

   # up-concat merge
   [-1, 1, nn.Upsample, [None, 2, 'nearest']],
   [[-1, 5], 1, Concat, [1]],  # cat backbone P3

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [256, 256, 128, 1]],  # 16 (P3/8-small)

   # avg-conv-down merge
   [-1, 1, ADown, [256]],
   [[-1, 13], 1, Concat, [1]],  # cat head P4

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 512, 256, 1]],  # 19 (P4/16-medium)

   # avg-conv-down merge
   [-1, 1, ADown, [512]],
   [[-1, 10], 1, Concat, [1]],  # cat head P5

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 512, 256, 1]],  # 22 (P5/32-large)
   
   
   # multi-level reversible auxiliary branch
   
   # routing
   [5, 1, CBLinear, [[256]]], # 23
   [7, 1, CBLinear, [[256, 512]]], # 24
   [9, 1, CBLinear, [[256, 512, 512]]], # 25
   
   # conv down
   [0, 1, Conv, [64, 3, 2]],  # 26-P1/2

   # conv down
   [-1, 1, Conv, [128, 3, 2]],  # 27-P2/4

   # elan-1 block
   [-1, 1, RepNCSPELAN4, [256, 128, 64, 1]],  # 28

   # avg-conv down fuse
   [-1, 1, ADown, [256]],  # 29-P3/8
   [[23, 24, 25, -1], 1, CBFuse, [[0, 0, 0]]], # 30  

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 256, 128, 1]],  # 31

   # avg-conv down fuse
   [-1, 1, ADown, [512]],  # 32-P4/16
   [[24, 25, -1], 1, CBFuse, [[1, 1]]], # 33 

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 512, 256, 1]],  # 34

   # avg-conv down fuse
   [-1, 1, ADown, [512]],  # 35-P5/32
   [[25, -1], 1, CBFuse, [[2]]], # 36

   # elan-2 block
   [-1, 1, RepNCSPELAN4, [512, 512, 256, 1]],  # 37
   [-1, 1, SCConv, []],  # 38

   
   
   # detection head

   # detect
   [[31, 34, 38, 16, 19, 22], 1, DualDDetect, [nc]],  # DualDDetect(A3, A4, A5, P3, P4, P5)
  ]

3.4 训练过程

最后，复制我们创建的模型配置，填入训练脚本（train_dual）中（不会训练的同学可以参考我之前的文章。），运行即可。

YOLOv9 最简训练教学！-CSDN博客

如果觉得本文章有用的话给博主点个关注吧！

原文地址：https://blog.csdn.net/StopAndGoyyy/article/details/136390378

免责声明：本站文章内容转载自网络资源，如本站内容侵犯了原著者的合法权益，可联系本站删除。更多内容请关注自学内容网（zxcms.com）！

上一篇：立式学习灯哪个牌子值得入手？五款入围落地灯揭秘，附加知识科普！
下一篇：第零章_计算机导论

【循环神经网络】
RNN是一种强大的序列建模工具，适合处理各种时间序列和自然语言数据。然而，传统RNN在处理长序列时存在梯度消失问题，随着LSTM和GRU等改进模型的引入，RNN的性能得到了极大提升。无论是在自然语言处
阅读更多2024-11-17
Linux---shell脚本
希望通过本文的学习，你能够掌握Shell脚本的基本知识和实用技巧，将Shell脚本融入到你的日常工作中，成为你提高工作效率、实现自动化任务的得力助手。让我们一起踏上这段探索Shell脚本的旅程，开启一
阅读更多2024-11-17
Linux-DNS
Linux中配置DNS服务，包括DNS工作流程、配置等、以及其他的一些需要注意的配置文件
阅读更多2024-11-17
DLL注入
在DLL注入的时候，起的是远程的线程在上面的参数中，lpStartAddress就是线程的函数，使用LoadLibrary的地址作为线程函数的地址，这样我们就可以用LoadLibrary来起lpPar
阅读更多2024-11-17
力扣62.不同路径
所以有从左上角到右下角的过程中，我们需要移动 m+n−2 次，其中有 m−1 次向下移动，n−1 次向右移动。由于我们每一步只能从向下或者向右移动一步，因此要想走到 (i,j)，如果向下走一步，那么
阅读更多2024-11-17
【JAVA毕业设计】基于Vue和SpringBoot的冬奥会科普平台
本文首先介绍了冬奥会科普管理的技术发展背景与发展现状，然后遵循软件常规开发流程，首先针对平台选取适用的语言和开发平台，根据需求分析制定模块并设计数据库结构，再根据平台总体功能模块的设计绘制平台的功能模
阅读更多2024-11-17
基于Spring Boot的电商系统开发策略
现代经济快节奏发展以及不断完善升级的信息化技术，让传统数据信息的管理升级为软件存储，归纳，集中处理数据信息的管理方式。网上商城系统的设计方案比如功能框架的设计，比如数据库的设计的好坏也就决定了该系统在
阅读更多2024-11-17
C++创建型模式之原型模式
通过原型设计模式，我们可以轻松地复制现有角色，避免了重复的构造代码，并且可以根据需要对克隆的角色进行微调。这种模式在复杂的游戏场景中非常有用，特别是在需要创建多个相似角色时。相似性：原型模式和拷贝构造
阅读更多2024-11-17
【C语言】前端未来
WebXR：WebXR是Web Reality Experience的缩写，它通过AR和VR技术提供沉浸式的交互体验，预计在未来会成为构建虚拟现实应用的重要平台，特别是结合混合现实设备如手机和头戴设备
阅读更多2024-11-17
ASUS/华硕灵耀X双屏Pro UX8402Z 原厂Win11-22H2系统工厂文件带ASUS Recovery恢复
系统，安装结束后带隐藏分区，一键恢复，以及机器所有驱动软件。请注意：仅支持以上型号专用，其他华硕机器切勿使用。需准备一个20G以上u盘进行恢复。系统版本：windows11。
阅读更多2024-11-17