【YOLOv5 Note-9】YOLOv5模型网络结构中加入MobileViT模块

yolov5

yolov5 - Ultralytics YOLOv8的前身，是一个用于目标检测、图像分割和图像分类任务的先进模型。

项目地址：https://gitcode.com/gh_mirrors/yo/yolov5

免费下载资源

风筝超冷

1298人浏览 · 2024-01-27 22:33:13

风筝超冷 · 2024-01-27 22:33:13 发布

一、神经网络的前中后期

在神经网络中，特别是在深度卷积神经网络（CNN）中，“网络早期（低层）”、“网络中期（中层）”和“网络后期（高层）”通常指的是网络结构中不同层级的部分，每个部分在特征提取和信息处理方面有其特定的作用和特性。

1. 网络早期（低层）

在网络的早期阶段插入 MobileViT 可能会对原始图像进行较深层次的处理，有助于捕捉更丰富的空间特征。但同时，Transformer可能无法充分利用其处理高级语义特征的能力。

2. 网络中期（中层）

在网络的中间层插入 MobileViT 可能是一个平衡点，可以在提取一定级别的特征后利用Transformer的长程依赖捕捉能力。

3. 网络后期（高层）

在网络的后期阶段插入 MobileViT 会使其处理更抽象的特征，有助于捕捉复杂的上下文信息，但可能会丢失一些细节信息。

二、插入 `MobileViT` 模块

在YOLOv5配置中插入 MobileViT 模块需要考虑到模块的功能和网络的整体架构。MobileViT 结合了卷积神经网络（CNN）和Transformer的特点，适合于复杂特征的提取和长程依赖的捕捉。基于这些考虑，以下是几个较为合适的的插入位置：

主干网络中的中期阶段：
- 例如，在 [-1, 1, Conv, [256, 3, 2]] 和 [-1, 6, C3, [256]] 之间。
- 这里，MobileViT 可以处理相对抽象的特征，并利用其Transformer部分捕捉更复杂的依赖关系。
主干网络后期：
- 在更深的层次，例如在 [-1, 1, Conv, [512, 3, 2]] 和 [-1, 9, C3, [512]] 之间。
- 在这个位置，MobileViT 将处理高级特征，并可能更好地利用Transformer结构处理复杂的场景。
检测头前期：
- 在检测头的初始阶段，例如在 [[17, 20, 23], 1, Detect, [nc, anchors]] 之前。
- 这可以使 MobileViT 直接对用于检测的特征进行最后的优化。

三、各类型YOLOv5模型的前中后期划分

以yolov5l.yaml为例

网络前期（低层）

定位：主干网络（backbone）的开始部分。
包含的层：
- [-1, 1, Conv, [64, 6, 2, 2]] # 0-P1/2
- [-1, 1, Conv, [128, 3, 2]] # 1-P2/4
作用：这些层主要负责捕获基础视觉特征，如边缘、纹理等。特征相对简单，更多关注细节。

网络中期（中层）

定位：主干网络中的中间部分。
包含的层：
- [-1, 3, C3, [128]]
- [-1, 1, Conv, [256, 3, 2]] # 3-P3/8
- [-1, 6, C3, [256]]
作用：这些层处理更复杂的特征，例如特定的形状和模式。开始从细节特征过渡到更抽象的特征表示。

网络后期（高层）

定位：主干网络的末尾以及检测头（head）。
包含的层：
- [-1, 1, Conv, [512, 3, 2]] # 5-P4/16
- [-1, 9, C3, [512]]
- [-1, 1, Conv, [1024, 3, 2]] # 7-P5/32
- [-1, 3, C3, [1024]]
- [-1, 1, SPPF, [1024, 5]] # 9
- 检测头（head）中的所有层
作用：这些层负责处理高级别的特征，通常与目标检测任务直接相关。在这里，特征更加抽象，与目标的类别、位置等信息密切相关。

代码实现 `MobileViT` 模块插入：

# YOLOv5 🚀 by Ultralytics, AGPL-3.0 license

# Parameters
nc: 80  # number of classes
depth_multiple: 1.0  # model depth multiple
width_multiple: 1.0  # layer channel multiple
anchors:
  - [10,13, 16,30, 33,23]  # P3/8
  - [30,61, 62,45, 59,119]  # P4/16
  - [116,90, 156,198, 373,326]  # P5/32

# YOLOv5 v6.0 backbone
backbone:
  # [from, number, module, args]
  [[-1, 1, Conv, [64, 6, 2, 2]],  # 0-P1/2
   [-1, 1, Conv, [128, 3, 2]],  # 1-P2/4
   [-1, 3, C3, [128]],
   [-1, 1, Conv, [256, 3, 2]],  # 3-P3/8
   [-1, 6, MobileViT, [256]],
   [-1, 6, C3, [256]],
   [-1, 1, Conv, [512, 3, 2]],  # 5-P4/16
   [-1, 6, MobileViT, [256]],
   [-1, 9, C3, [512]],
   [-1, 1, Conv, [1024, 3, 2]],  # 7-P5/32
   [-1, 3, C3, [1024]],
   [-1, 1, SPPF, [1024, 5]],  # 9
  ]

# YOLOv5 v6.0 head
head:
  [[-1, 1, Conv, [512, 1, 1]],
   [-1, 1, nn.Upsample, [None, 2, 'nearest']],
   [[-1, 6], 1, Concat, [1]],  # cat backbone P4
   [-1, 3, C3, [512, False]],  # 13

   [-1, 1, Conv, [256, 1, 1]],
   [-1, 1, nn.Upsample, [None, 2, 'nearest']],
   [[-1, 4], 1, Concat, [1]],  # cat backbone P3
   [-1, 3, C3, [256, False]],  # 17 (P3/8-small)

   [-1, 1, Conv, [256, 3, 2]],
   [[-1, 14], 1, Concat, [1]],  # cat head P4
   [-1, 3, C3, [512, False]],  # 20 (P4/16-medium)
   [-1, 3, MobileViT, [512, False]],

   [-1, 1, Conv, [512, 3, 2]],
   [[-1, 10], 1, Concat, [1]],  # cat head P5 
   [-1, 3, C3, [1024, False]],  # 23 (P5/32-large)

   [[17, 20, 23], 1, Detect, [nc, anchors]],  # Detect(P3, P4, P5)
  ]

GitHub 加速计划 / yo / yolov5

49.32 K

16.02 K

下载

yolov5 - Ultralytics YOLOv8的前身，是一个用于目标检测、图像分割和图像分类任务的先进模型。

最近提交(Master分支：1 个月前 )

a3555241 Signed-off-by: Glenn Jocher <glenn.jocher@ultralytics.com> 2 天前

6629839d Refactor code for speed and clarity 8 天前

GitCode 开源社区

旨在为数千万中国开发者提供一个无缝且高效的云端环境，以支持学习、使用和贡献开源项目。

更多推荐

[转载]在Windows环境下安装GNU Radio

转自：在Windows环境下安装GNURadio_恐弱智_新浪博客GNU Radio是用Python开发的，大部分开源的工程能够在Linux环境下运行良好，而Windows下却运行的很勉强，而且安装配置都很复杂。GNU Radio算是个例外了，不光提供了Windows的二进制安装，还有比较详细的说明。我是Python小白，所以折腾了好久才弄好，特意记录下来，免得以后再装还折腾。GNU Radio的

GitCode 开源社区

centOS 8 使用dnf安装Docker

DNF是什么？CentOS 8使用YUM软件包管理器版本v4.0.4。现在，该版本使用DNF(已删除YUM)。DNF是软件包管理器。它会在Linux发行版上安装，执行更新并删除软件包。使用DNF安装Docker跳过具有损坏依赖性的程序包一个有效的解决方案是使您的CentOS 8系统使用以下--nobest命令安装最符合条件的版本：sudo dnf install docker...

GitCode 开源社区

定时同步数据库表(mysql+linux+crontab)

sync.sh里面的参数需要改变，ip/username/password/database/tablesync.sh#!/bin/sh# Please change the IP and password of the data source db.# Then change the table name.filename=/home/nington/db/$(date +%Y-%m