Dilated Convolution膨胀卷积感受野详解

2024-04-21 04:32

本文主要是介绍Dilated Convolution膨胀卷积感受野详解,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

重温Dilated Convolution膨胀卷积,对论文《MULTI-SCALE CONTEXT AGGREGATION BY DILATED CONVOLUTIONS》中采用Dilation后的感受野计算示意图产生了迷惑,于是自己重新画图琢磨了一番。
论文中感受野计算示意图
可以看到作者的感受野计算是递进式的,即F1在F0的基础上经3x3,dilation=1卷积得到,即F2在F1的基础上经3x3,dilation=2卷积得到,即F3在F2的基础上经3x3,dilation=4卷积得到,最终F1、F2、F3各自的感受野分别是3x3、7x7、15x15。

这几个数字如果按图示来看无法直观感受到感受野变化的过程,很容易产生迷惑。

在研究变化过程前,需要清楚一个概念,就是每一层的最终感受野是指相对原始图像而言的,在图示中指F0。在清楚这一概念后,则可以开始研究采用dilation后的感受野变化情况。

(1)对原始图F0,采用3x3,dilation=1(即普通卷积)卷积核卷积得到特征图,特征图的每一个单元的感受野则是3x3。这个很好理解。
膨胀卷积1
(2)进一步,对原始图F0,采用3x3,dilation=2卷积核卷积得到特征图,特征图的每一个单元的感受野则是5x5。
膨胀卷积2
(3)再进一步,对原始图F0,采用3x3,dilation=4卷积核卷积得到特征图,特征图的每一个单元的感受野则是9x9。
膨胀卷积3

请注意,以上的计算都是卷积直接在原始图F0上进行,因此可以直观看出特征图单个元素对应的感受野。而在原论文中则是递进式的,采用dilation=2/4的卷积核不再是在原始图F0上进行卷积的,这是主要差异。因此感受野计算需要进一步映射。

(4)对原始图F0,先采用3x3,dilation=1(即普通卷积)卷积核卷积得到特征图F1。再采用3x3,dilation=2卷积核卷积得到特征图F2,特征图F2的每一个单元映射回F1后(临时)感受野是5×5,再从F1映射回原始图F0的感受野是[3×3]+(5-1)=[7×7]。则F2每一个单元的最终感受野是7x7,和论文中的F2感受野一致。

注1:(临时)感受野指的是对应前一层特征图的感受野,非对应原始图,不是最终的感受野。
注2:[3×3]是因为F1中的每一个方格对应F0中的3×3个方格,(5-1)是因为需要将3×3卷积核继续平滑4次来生成F1的剩余部分。

膨胀卷积4
(5)对原始图F0,先采用3x3,dilation=1(即普通卷积)卷积核卷积得到特征图F1。再采用3x3,dilation=2卷积核卷积得到特征图F2,最后采用3x3,dilation=4卷积核卷积得到特征图F3。特征图F3的每一个单元映射回F2后(临时)感受野是9×9,再从F2映射回F1的(临时)感受野是[5×5]+(9-1)=[13×13],最后从F1映射回原始图F0的感受野是[3×3]+(13-1)=[15×15]。则F3每一个单元的最终感受野是15x15,和论文中的F3感受野一致。

注1:(X-1)是因为需要将3×3卷积核继续平滑X-1次来生成特征图的剩余部分,
注2:从F2映射回F1的过程可以直接用F1已映射回F0的感受野来计算,不用再进一步回推。即利用F1对应的原始图感受野[7×7],直接得到F2映射回F0的感受野[7×7]+(9-1)=[15×15]。

膨胀卷积5
结论:
根据以上图示,能够更加清楚采用Dilated Convolution膨胀卷积后感受野变化的情况,再次强调需要注意的是感受野指的是相对于原始图而言的,因此对于经过多层卷积后得到的特征图的感受野计算,需要层层回退到原始图,最终求得的感受野大小则为所得特征图单个元素的真正感受野。

在这里插入图片描述

这篇关于Dilated Convolution膨胀卷积感受野详解的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/922163

相关文章

MySQL数据库双机热备的配置方法详解

《MySQL数据库双机热备的配置方法详解》在企业级应用中,数据库的高可用性和数据的安全性是至关重要的,MySQL作为最流行的开源关系型数据库管理系统之一,提供了多种方式来实现高可用性,其中双机热备(M... 目录1. 环境准备1.1 安装mysql1.2 配置MySQL1.2.1 主服务器配置1.2.2 从

Linux kill正在执行的后台任务 kill进程组使用详解

《Linuxkill正在执行的后台任务kill进程组使用详解》文章介绍了两个脚本的功能和区别,以及执行这些脚本时遇到的进程管理问题,通过查看进程树、使用`kill`命令和`lsof`命令,分析了子... 目录零. 用到的命令一. 待执行的脚本二. 执行含子进程的脚本,并kill2.1 进程查看2.2 遇到的

MyBatis常用XML语法详解

《MyBatis常用XML语法详解》文章介绍了MyBatis常用XML语法,包括结果映射、查询语句、插入语句、更新语句、删除语句、动态SQL标签以及ehcache.xml文件的使用,感兴趣的朋友跟随小... 目录1、定义结果映射2、查询语句3、插入语句4、更新语句5、删除语句6、动态 SQL 标签7、ehc

详解SpringBoot+Ehcache使用示例

《详解SpringBoot+Ehcache使用示例》本文介绍了SpringBoot中配置Ehcache、自定义get/set方式,并实际使用缓存的过程,文中通过示例代码介绍的非常详细,对大家的学习或者... 目录摘要概念内存与磁盘持久化存储:配置灵活性:编码示例引入依赖:配置ehcache.XML文件:配置

从基础到高级详解Go语言中错误处理的实践指南

《从基础到高级详解Go语言中错误处理的实践指南》Go语言采用了一种独特而明确的错误处理哲学,与其他主流编程语言形成鲜明对比,本文将为大家详细介绍Go语言中错误处理详细方法,希望对大家有所帮助... 目录1 Go 错误处理哲学与核心机制1.1 错误接口设计1.2 错误与异常的区别2 错误创建与检查2.1 基础

k8s按需创建PV和使用PVC详解

《k8s按需创建PV和使用PVC详解》Kubernetes中,PV和PVC用于管理持久存储,StorageClass实现动态PV分配,PVC声明存储需求并绑定PV,通过kubectl验证状态,注意回收... 目录1.按需创建 PV(使用 StorageClass)创建 StorageClass2.创建 PV

Python版本信息获取方法详解与实战

《Python版本信息获取方法详解与实战》在Python开发中,获取Python版本号是调试、兼容性检查和版本控制的重要基础操作,本文详细介绍了如何使用sys和platform模块获取Python的主... 目录1. python版本号获取基础2. 使用sys模块获取版本信息2.1 sys模块概述2.1.1

一文详解Python如何开发游戏

《一文详解Python如何开发游戏》Python是一种非常流行的编程语言,也可以用来开发游戏模组,:本文主要介绍Python如何开发游戏的相关资料,文中通过代码介绍的非常详细,需要的朋友可以参考下... 目录一、python简介二、Python 开发 2D 游戏的优劣势优势缺点三、Python 开发 3D

Redis 基本数据类型和使用详解

《Redis基本数据类型和使用详解》String是Redis最基本的数据类型,一个键对应一个值,它的功能十分强大,可以存储字符串、整数、浮点数等多种数据格式,本文给大家介绍Redis基本数据类型和... 目录一、Redis 入门介绍二、Redis 的五大基本数据类型2.1 String 类型2.2 Hash

Java中的.close()举例详解

《Java中的.close()举例详解》.close()方法只适用于通过window.open()打开的弹出窗口,对于浏览器的主窗口,如果没有得到用户允许是不能关闭的,:本文主要介绍Java中的.... 目录当你遇到以下三种情况时,一定要记得使用 .close():用法作用举例如何判断代码中的 input