【YOLOv9改进[Conv]】使用DualConv助力V9更优秀

2024-04-24 16:04

本文主要是介绍【YOLOv9改进[Conv]】使用DualConv助力V9更优秀,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

目录

一 DualConv(2022)

1 结合3×3卷积和1×1卷积核

2 DualConv

3 可视化

二 使用DualConv助力V9更优秀

1 整体修改

2 配置文件

3 训练


一 DualConv(2022)

官方论文地址:https://arxiv.org/pdf/2202.07481.pdf

论文中提出了结合3×3卷积和1×1卷积的DualConv,解决了跨通道通信和原始输入特征映射中信息保存的问题。与HetConv相比,DualConv通过添加最少的参数来提高网络性能。将DualConv应用于常见的网络结构中进行图像分类和目标检测。通过比较标准卷积和DualConv的实验结果,验证了该方法的有效性和高效性。从实验结果来看,DualConv可以集成在标准和轻量级网络架构中,以提高网络精度,减少网络参数、计算成本和推理时间。本文还证明了DualConv可以很好地拟合各种图像数据集,并且具有很强的泛化能力。未来的研究工作将集中在嵌入式设备上的部署,以进一步证明DualConv在实际应用中的效率。

综上,DualConv的特点包括两个方面:

合3×3卷积和1×1卷积

使用组卷积技术高效地安排卷积滤波器

1 结合3×3卷积和1×1卷积核

3×3卷积核在进行特征提取时可以捕获更多的空间信息,而1×1卷积核则可以在不增加过多参数和计算复杂度的前提下,进行特征通道之间的交互和信息整合。如下图1所示:

(a)标准卷积

(b)深度可分离卷积

(c)群卷积

(d)异质卷积

(e)提出DualConv。M输入通道数(即输入特征图的深度),N卷积滤波器数输出通道数(即输出特征图的深度),Di输入特征图的宽度和高度维度K × K卷积核大小G为群卷积和对偶卷积的组数,1/P为异构卷积中3×3卷积核的比值。注意,异构过滤器以移位的方式排列。

2 DualConv

下图2为 DualConv的结构。

3 可视化

如下图3:ImageNet数据集上ResNet-50和MobileNetV1网络的示例图像的可视化。

(a)为原始输入图像

(b) ~ (g)为在ResNet-50网络上通过Grad-CAM方法获得的热图

(h) ~ (m)是在ResNet-50网络上结合引导反向传播与Grad-CAM的引导Grad-CAM可视化图

(n) ~ (s)是在MobileNetV1网络上通过Grad-CAM方法获得的热图

(t) ~ (y)是在MobileNetV1网络上结合引导反向传播与Grad-CAM的引导Grad-CAM可视化图

二 使用DualConv助力V9更优秀

1 整体修改

① 新建 DualConv.py文件

在yolov9/models目录下新建DualConv.py文件,文件内容如下:

② 修改yolov9/models/yolo.py文件

搜索“parse_model”的部分,进行如下修改:

2 配置文件

yolov9-c_DualConv.yaml的内容与原始文件对比如下:

backbone

head

3 训练

上述修改完毕后,我们开始训练吧!🌺🌺🌺

训练示例

cd yolov9项目路径# 激活yolov9环境
conda activate yolov9# 开始训练
python3 train_dual.py --cfg=models/detect/yolov9-c_DualConv.yaml --data=data/fire.yaml --epoch=100 --batch-size=4 --imgsz=640 --hyp=data/hyps/hyp.scratch-high.yaml

先关注 + 点赞 + 评论,然后私信作者DualConv.py文件和yolov9-c_DualConv.yaml文件吧

到此,本文分享的内容就结束啦!遇见便是缘,感恩遇见!!!💛 💙 💜 ❤️ 💚 

未完待续。。

这篇关于【YOLOv9改进[Conv]】使用DualConv助力V9更优秀的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/932186

相关文章

C语言中联合体union的使用

本文编辑整理自: http://bbs.chinaunix.net/forum.php?mod=viewthread&tid=179471 一、前言 “联合体”(union)与“结构体”(struct)有一些相似之处。但两者有本质上的不同。在结构体中,各成员有各自的内存空间, 一个结构变量的总长度是各成员长度之和。而在“联合”中,各成员共享一段内存空间, 一个联合变量

Tolua使用笔记(上)

目录   1.准备工作 2.运行例子 01.HelloWorld:在C#中,创建和销毁Lua虚拟机 和 简单调用。 02.ScriptsFromFile:在C#中,对一个lua文件的执行调用 03.CallLuaFunction:在C#中,对lua函数的操作 04.AccessingLuaVariables:在C#中,对lua变量的操作 05.LuaCoroutine:在Lua中,

Vim使用基础篇

本文内容大部分来自 vimtutor,自带的教程的总结。在终端输入vimtutor 即可进入教程。 先总结一下,然后再分别介绍正常模式,插入模式,和可视模式三种模式下的命令。 目录 看完以后的汇总 1.正常模式(Normal模式) 1.移动光标 2.删除 3.【:】输入符 4.撤销 5.替换 6.重复命令【. ; ,】 7.复制粘贴 8.缩进 2.插入模式 INSERT

Lipowerline5.0 雷达电力应用软件下载使用

1.配网数据处理分析 针对配网线路点云数据,优化了分类算法,支持杆塔、导线、交跨线、建筑物、地面点和其他线路的自动分类;一键生成危险点报告和交跨报告;还能生成点云数据采集航线和自主巡检航线。 获取软件安装包联系邮箱:2895356150@qq.com,资源源于网络,本介绍用于学习使用,如有侵权请您联系删除! 2.新增快速版,简洁易上手 支持快速版和专业版切换使用,快速版界面简洁,保留主

如何免费的去使用connectedpapers?

免费使用connectedpapers 1. 打开谷歌浏览器2. 按住ctrl+shift+N,进入无痕模式3. 不需要登录(也就是访客模式)4. 两次用完,关闭无痕模式(继续重复步骤 2 - 4) 1. 打开谷歌浏览器 2. 按住ctrl+shift+N,进入无痕模式 输入网址:https://www.connectedpapers.com/ 3. 不需要登录(也就是

(超详细)YOLOV7改进-Soft-NMS(支持多种IoU变种选择)

1.在until/general.py文件最后加上下面代码 2.在general.py里面找到这代码,修改这两个地方 3.之后直接运行即可

YOLOv8改进 | SPPF | 具有多尺度带孔卷积层的ASPP【CVPR2018】

💡💡💡本专栏所有程序均经过测试,可成功执行💡💡💡 专栏目录 :《YOLOv8改进有效涨点》专栏介绍 & 专栏目录 | 目前已有40+篇内容,内含各种Head检测头、损失函数Loss、Backbone、Neck、NMS等创新点改进——点击即可跳转 Atrous Spatial Pyramid Pooling (ASPP) 是一种在深度学习框架中用于语义分割的网络结构,它旨

Toolbar+DrawerLayout使用详情结合网络各大神

最近也想搞下toolbar+drawerlayout的使用。结合网络上各大神的杰作,我把大部分的内容效果都完成了遍。现在记录下各个功能效果的实现以及一些细节注意点。 这图弹出两个菜单内容都是仿QQ界面的选项。左边一个是drawerlayout的弹窗。右边是toolbar的popup弹窗。 开始实现步骤详情: 1.创建toolbar布局跟drawerlayout布局 <?xml vers

C#中,decimal类型使用

在Microsoft SQL Server中numeric类型,在C#中使用的时候,需要用decimal类型与其对应,不能使用int等类型。 SQL:numeric C#:decimal

探索Elastic Search:强大的开源搜索引擎,详解及使用

🎬 鸽芷咕:个人主页  🔥 个人专栏: 《C++干货基地》《粉丝福利》 ⛺️生活的理想,就是为了理想的生活! 引入 全文搜索属于最常见的需求,开源的 Elasticsearch (以下简称 Elastic)是目前全文搜索引擎的首选,相信大家多多少少的都听说过它。它可以快速地储存、搜索和分析海量数据。就连维基百科、Stack Overflow、