Dilated Convolution膨胀卷积感受野详解

2024-04-21 04:32

本文主要是介绍Dilated Convolution膨胀卷积感受野详解,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

重温Dilated Convolution膨胀卷积,对论文《MULTI-SCALE CONTEXT AGGREGATION BY DILATED CONVOLUTIONS》中采用Dilation后的感受野计算示意图产生了迷惑,于是自己重新画图琢磨了一番。
论文中感受野计算示意图
可以看到作者的感受野计算是递进式的,即F1在F0的基础上经3x3,dilation=1卷积得到,即F2在F1的基础上经3x3,dilation=2卷积得到,即F3在F2的基础上经3x3,dilation=4卷积得到,最终F1、F2、F3各自的感受野分别是3x3、7x7、15x15。

这几个数字如果按图示来看无法直观感受到感受野变化的过程,很容易产生迷惑。

在研究变化过程前,需要清楚一个概念,就是每一层的最终感受野是指相对原始图像而言的,在图示中指F0。在清楚这一概念后,则可以开始研究采用dilation后的感受野变化情况。

(1)对原始图F0,采用3x3,dilation=1(即普通卷积)卷积核卷积得到特征图,特征图的每一个单元的感受野则是3x3。这个很好理解。
膨胀卷积1
(2)进一步,对原始图F0,采用3x3,dilation=2卷积核卷积得到特征图,特征图的每一个单元的感受野则是5x5。
膨胀卷积2
(3)再进一步,对原始图F0,采用3x3,dilation=4卷积核卷积得到特征图,特征图的每一个单元的感受野则是9x9。
膨胀卷积3

请注意,以上的计算都是卷积直接在原始图F0上进行,因此可以直观看出特征图单个元素对应的感受野。而在原论文中则是递进式的,采用dilation=2/4的卷积核不再是在原始图F0上进行卷积的,这是主要差异。因此感受野计算需要进一步映射。

(4)对原始图F0,先采用3x3,dilation=1(即普通卷积)卷积核卷积得到特征图F1。再采用3x3,dilation=2卷积核卷积得到特征图F2,特征图F2的每一个单元映射回F1后(临时)感受野是5×5,再从F1映射回原始图F0的感受野是[3×3]+(5-1)=[7×7]。则F2每一个单元的最终感受野是7x7,和论文中的F2感受野一致。

注1:(临时)感受野指的是对应前一层特征图的感受野,非对应原始图,不是最终的感受野。
注2:[3×3]是因为F1中的每一个方格对应F0中的3×3个方格,(5-1)是因为需要将3×3卷积核继续平滑4次来生成F1的剩余部分。

膨胀卷积4
(5)对原始图F0,先采用3x3,dilation=1(即普通卷积)卷积核卷积得到特征图F1。再采用3x3,dilation=2卷积核卷积得到特征图F2,最后采用3x3,dilation=4卷积核卷积得到特征图F3。特征图F3的每一个单元映射回F2后(临时)感受野是9×9,再从F2映射回F1的(临时)感受野是[5×5]+(9-1)=[13×13],最后从F1映射回原始图F0的感受野是[3×3]+(13-1)=[15×15]。则F3每一个单元的最终感受野是15x15,和论文中的F3感受野一致。

注1:(X-1)是因为需要将3×3卷积核继续平滑X-1次来生成特征图的剩余部分,
注2:从F2映射回F1的过程可以直接用F1已映射回F0的感受野来计算,不用再进一步回推。即利用F1对应的原始图感受野[7×7],直接得到F2映射回F0的感受野[7×7]+(9-1)=[15×15]。

膨胀卷积5
结论:
根据以上图示,能够更加清楚采用Dilated Convolution膨胀卷积后感受野变化的情况,再次强调需要注意的是感受野指的是相对于原始图而言的,因此对于经过多层卷积后得到的特征图的感受野计算,需要层层回退到原始图,最终求得的感受野大小则为所得特征图单个元素的真正感受野。

在这里插入图片描述

这篇关于Dilated Convolution膨胀卷积感受野详解的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/922163

相关文章

Nginx中location实现多条件匹配的方法详解

《Nginx中location实现多条件匹配的方法详解》在Nginx中,location指令用于匹配请求的URI,虽然location本身是基于单一匹配规则的,但可以通过多种方式实现多个条件的匹配逻辑... 目录1. 概述2. 实现多条件匹配的方式2.1 使用多个 location 块2.2 使用正则表达式

spring @EventListener 事件与监听的示例详解

《spring@EventListener事件与监听的示例详解》本文介绍了自定义Spring事件和监听器的方法,包括如何发布事件、监听事件以及如何处理异步事件,通过示例代码和日志,展示了事件的顺序... 目录1、自定义Application Event2、自定义监听3、测试4、源代码5、其他5.1 顺序执行

Java之并行流(Parallel Stream)使用详解

《Java之并行流(ParallelStream)使用详解》Java并行流(ParallelStream)通过多线程并行处理集合数据,利用Fork/Join框架加速计算,适用于大规模数据集和计算密集... 目录Java并行流(Parallel Stream)1. 核心概念与原理2. 创建并行流的方式3. 适

web网络安全之跨站脚本攻击(XSS)详解

《web网络安全之跨站脚本攻击(XSS)详解》:本文主要介绍web网络安全之跨站脚本攻击(XSS)的相关资料,跨站脚本攻击XSS是一种常见的Web安全漏洞,攻击者通过注入恶意脚本诱使用户执行,可能... 目录前言XSS 的类型1. 存储型 XSS(Stored XSS)示例:危害:2. 反射型 XSS(Re

linux本机进程间通信之UDS详解

《linux本机进程间通信之UDS详解》文章介绍了Unix域套接字(UDS)的使用方法,这是一种在同一台主机上不同进程间通信的方式,UDS支持三种套接字类型:SOCK_STREAM、SOCK_DGRA... 目录基础概念本机进程间通信socket实现AF_INET数据收发示意图AF_Unix数据收发流程图A

Go 1.23中Timer无buffer的实现方式详解

《Go1.23中Timer无buffer的实现方式详解》在Go1.23中,Timer的实现通常是通过time包提供的time.Timer类型来实现的,本文主要介绍了Go1.23中Timer无buff... 目录Timer 的基本实现无缓冲区的实现自定义无缓冲 Timer 实现更复杂的 Timer 实现总结在

Vue中动态权限到按钮的完整实现方案详解

《Vue中动态权限到按钮的完整实现方案详解》这篇文章主要为大家详细介绍了Vue如何在现有方案的基础上加入对路由的增、删、改、查权限控制,感兴趣的小伙伴可以跟随小编一起学习一下... 目录一、数据库设计扩展1.1 修改路由表(routes)1.2 修改角色与路由权限表(role_routes)二、后端接口设计

MySQL 日期时间格式化函数 DATE_FORMAT() 的使用示例详解

《MySQL日期时间格式化函数DATE_FORMAT()的使用示例详解》`DATE_FORMAT()`是MySQL中用于格式化日期时间的函数,本文详细介绍了其语法、格式化字符串的含义以及常见日期... 目录一、DATE_FORMAT()语法二、格式化字符串详解三、常见日期时间格式组合四、业务场景五、总结一、

Qt实现发送HTTP请求的示例详解

《Qt实现发送HTTP请求的示例详解》这篇文章主要为大家详细介绍了如何通过Qt实现发送HTTP请求,文中的示例代码讲解详细,具有一定的借鉴价值,感兴趣的小伙伴可以跟随小编一起学习一下... 目录1、添加network模块2、包含改头文件3、创建网络访问管理器4、创建接口5、创建网络请求对象6、创建一个回复对

Apache伪静态(Rewrite).htaccess文件详解与配置技巧

《Apache伪静态(Rewrite).htaccess文件详解与配置技巧》Apache伪静态(Rewrite).htaccess是一个纯文本文件,它里面存放着Apache服务器配置相关的指令,主要的... 一、.htAccess的基本作用.htaccess是一个纯文本文件,它里面存放着Apache服务器