一文让你看懂转置卷积(反卷积,分数卷积),非常详细的图解描述

2024-06-21 09:32

本文主要是介绍一文让你看懂转置卷积(反卷积,分数卷积),非常详细的图解描述,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

点击上方“AI公园”,关注公众号,选择加“星标“或“置顶”


者:Naoki Shibuya

编译:ronghuaiyang

导读

    如果你听说过转置卷积并对它的实际含义感到困惑,这篇文章就是为你写的

如果你听说过转置卷积并对它的实际含义感到困惑,这篇文章就是为你写的。

上采样的需求

当我们使用神经网络来生成图像的时候,通常需要从低分辨率的图像上采样成高分辨率的图像。

640?wx_fmt=png

有很多的方法来实现上采样的操作:

  • 最近邻插值

  • 双线性插值

  • 双三次插值

这些方法都涉及插值,需要在确定网络结构时进行选择。它就像一个手工的特征工程,网络对此一无所知。

为什么用转置卷积?

如果我们想要我们的网络学习到如何最优化的进行上采样,我们可以使用转置卷积。它没有使用预先定义好的插值方法,具有可学习的参数。

理解转置卷积的概念非常有用,因为在一些重要的论文和工程都都会用到,比如:

  • 在DCGAN中,生成器使用随机采样的值来生成全尺寸的图像。

  • 在语义分割中,在编码阶段使用卷积层来抽取特征,然后在解码阶段,恢复原始的图像尺寸,对原始图像的每一个像素进行分类。

转置卷积也称为:

  • 分数步长的卷积

  • 反卷积

在文中,我们只会使用反卷积,但是你需要在其他的文章中注意一下其他的名字。

卷积操作

我们用一个简单的例子来解释一下卷积是怎么工作的。假设我们有一个4x4的矩阵,需要在上面使用一个3x3的卷积核进行卷积操作,不做padding,步长为1。如下面所示,输出为2x2的矩阵。

640?wx_fmt=png

卷积操作


卷积运算计算输入矩阵和核矩阵之间的元素乘积的和。因为我们没有padding,步长为1,我们只能做4次。因此,输出矩阵是2x2的 。

640?wx_fmt=png

对应元素相乘再求和


这种卷积运算的一个重要特点是输入值和输出值之间存在位置连通性。

例如,输入矩阵的左上角值影响输出矩阵的左上角值。

更具体地说,3x3卷积核用于连接输入矩阵中的9个值和输出矩阵中的1个值。卷积运算形成多对一关系。让我们记住这一点,因为我们以后需要它。

反过来

现在,假设我们想要反过来操作。我们想把一个矩阵中的1个值和另一个矩阵中的9个值联系起来。这是一对多的关系。这就像是卷积运算的反运算,它是转置卷积的核心思想。

例如,我们上采样一个2x2矩阵到一个4x4矩阵。这个操作维护了一个1到9的关系。

640?wx_fmt=png

卷积运算反过来

但是我们怎么来进行这样的操作呢?

为了讨论如何进行这个操作,我们需要定义卷积矩阵转置卷积矩阵

卷积矩阵

我们可以用矩阵来表示卷积运算。它只是一个重新排列的卷积核矩阵,这样我们就可以用矩阵乘法来进行卷积运算了。

640?wx_fmt=png

我们将3x3卷积核重新排列为4x16的矩阵如下:

640?wx_fmt=png

这就是卷积矩阵。每一行定义一个卷积运算。如果你看不懂上面的图的话,下面的图表可能会有所帮助。卷积矩阵的每一行只是一个重新排列的卷积核矩阵,在不同的地方用零来填充。

640?wx_fmt=png

为了使用这个矩阵,我们把输入矩阵 (4x4)拉平成一个列向量 (16x1)。

640?wx_fmt=png

拉平了的输入矩阵

我们可以将4x16卷积矩阵与16x1输入矩阵(16维列向量)相乘。

640?wx_fmt=png

输出的4x1矩阵可以被reshape成2x2的矩阵,得到与之前相同的结果。

640?wx_fmt=png

总之,卷积矩阵就是对卷积核权值重新排列的矩阵,卷积运算可以通过使用卷积矩阵表示。

那又怎样呢?

重点是使用卷积矩阵,你可以从16 (4x4)到4 (2x2)因为卷积矩阵是4x16。然后,如果你有一个16x4的矩阵,你可以从4 (2x2)到16 (4x4)。

是不是有点懵逼?

请继续读下去。

转置卷积矩阵

我们想要从4 (2x2)到16 (4x4),所以,我们使用一个16x4的矩阵。但是,还有一样,我们要得到一个1到9的关系。

假设我们将卷积矩阵C (4x16)转置到C.T (16x4)。我们可以对C用一个列向量(4x1)使用矩阵乘法,生成一个输出矩阵(16x1)。转置矩阵将1个值与输出中的9个值连接起来。

640?wx_fmt=png

使用矩阵乘法来做卷积

将输出reshape成4x4。

640?wx_fmt=png

我们刚刚将一个较小的矩阵(2x2)上采样到一个较大的矩阵(4x4)。由于转置卷积重新排列权值的方式,它保持了1到9的关系。

注意:矩阵中的实际权值不一定来自原始卷积矩阵。重要的是权重的排布是由卷积矩阵的转置得来的。

总结

转置卷积运算与普通卷积形成相同的连通性,但方向是反向的。

我们可以用它来进行上采样。此外,转置卷积的权值是可以学习的。所以我们不需要一个预定义的插值方法。

尽管它被称为转置卷积,但这并不意味着我们取某个已有的卷积矩阵并使用转置后的版本。重点是,与标准卷积矩阵(一对多关联而不是多对一关联)相比,输入和输出之间的关联是以反向的方式处理的。

因此,转置卷积不是卷积。但是我们可以用卷积来模拟转置卷积。我们通过在输入矩阵的值之间加零来对输入进行上采样,这样直接卷积就会产生与转置卷积相同的效果。你可能会发现一些文章用这种方式解释了转置卷积。但是,由于需要在卷积之前对输入进行上采样,所以效率较低。

注意事项:转置卷积是生成图像中棋盘伪影的原因。本文推荐上采样操作(即插值的方法),然后进行卷积运算来减少这些问题。如果你的主要目标是生成没有这些伪影的图像,那么阅读本文以了解更多信息是值得的。

640?wx_fmt=png— END—

英文原文:https://towardsdatascience.com/up-sampling-with-transposed-convolution-9ae4f2df52d0

640?wx_fmt=jpeg

请长按或扫描二维码关注本公众号

喜欢的话,请给我个好看吧640?wx_fmt=gif

这篇关于一文让你看懂转置卷积(反卷积,分数卷积),非常详细的图解描述的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1080847

相关文章

IntelliJ IDEA 中配置 Spring MVC 环境的详细步骤及问题解决

《IntelliJIDEA中配置SpringMVC环境的详细步骤及问题解决》:本文主要介绍IntelliJIDEA中配置SpringMVC环境的详细步骤及问题解决,本文分步骤结合实例给大... 目录步骤 1:创建 Maven Web 项目步骤 2:添加 Spring MVC 依赖1、保存后执行2、将新的依赖

一文详解Java异常处理你都了解哪些知识

《一文详解Java异常处理你都了解哪些知识》:本文主要介绍Java异常处理的相关资料,包括异常的分类、捕获和处理异常的语法、常见的异常类型以及自定义异常的实现,文中通过代码介绍的非常详细,需要的朋... 目录前言一、什么是异常二、异常的分类2.1 受检异常2.2 非受检异常三、异常处理的语法3.1 try-

如何为Yarn配置国内源的详细教程

《如何为Yarn配置国内源的详细教程》在使用Yarn进行项目开发时,由于网络原因,直接使用官方源可能会导致下载速度慢或连接失败,配置国内源可以显著提高包的下载速度和稳定性,本文将详细介绍如何为Yarn... 目录一、查询当前使用的镜像源二、设置国内源1. 设置为淘宝镜像源2. 设置为其他国内源三、还原为官方

最详细安装 PostgreSQL方法及常见问题解决

《最详细安装PostgreSQL方法及常见问题解决》:本文主要介绍最详细安装PostgreSQL方法及常见问题解决,介绍了在Windows系统上安装PostgreSQL及Linux系统上安装Po... 目录一、在 Windows 系统上安装 PostgreSQL1. 下载 PostgreSQL 安装包2.

一文带你搞懂Python中__init__.py到底是什么

《一文带你搞懂Python中__init__.py到底是什么》朋友们,今天我们来聊聊Python里一个低调却至关重要的文件——__init__.py,有些人可能听说过它是“包的标志”,也有人觉得它“没... 目录先搞懂 python 模块(module)Python 包(package)是啥?那么 __in

MySql match against工具详细用法

《MySqlmatchagainst工具详细用法》在MySQL中,MATCH……AGAINST是全文索引(Full-Textindex)的查询语法,它允许你对文本进行高效的全文搜素,支持自然语言搜... 目录一、全文索引的基本概念二、创建全文索引三、自然语言搜索四、布尔搜索五、相关性排序六、全文索引的限制七

python中各种常见文件的读写操作与类型转换详细指南

《python中各种常见文件的读写操作与类型转换详细指南》这篇文章主要为大家详细介绍了python中各种常见文件(txt,xls,csv,sql,二进制文件)的读写操作与类型转换,感兴趣的小伙伴可以跟... 目录1.文件txt读写标准用法1.1写入文件1.2读取文件2. 二进制文件读取3. 大文件读取3.1

Linux内核参数配置与验证详细指南

《Linux内核参数配置与验证详细指南》在Linux系统运维和性能优化中,内核参数(sysctl)的配置至关重要,本文主要来聊聊如何配置与验证这些Linux内核参数,希望对大家有一定的帮助... 目录1. 引言2. 内核参数的作用3. 如何设置内核参数3.1 临时设置(重启失效)3.2 永久设置(重启仍生效

一文详解如何在Python中从字符串中提取部分内容

《一文详解如何在Python中从字符串中提取部分内容》:本文主要介绍如何在Python中从字符串中提取部分内容的相关资料,包括使用正则表达式、Pyparsing库、AST(抽象语法树)、字符串操作... 目录前言解决方案方法一:使用正则表达式方法二:使用 Pyparsing方法三:使用 AST方法四:使用字

如何在Mac上安装并配置JDK环境变量详细步骤

《如何在Mac上安装并配置JDK环境变量详细步骤》:本文主要介绍如何在Mac上安装并配置JDK环境变量详细步骤,包括下载JDK、安装JDK、配置环境变量、验证JDK配置以及可选地设置PowerSh... 目录步骤 1:下载JDK步骤 2:安装JDK步骤 3:配置环境变量1. 编辑~/.zshrc(对于zsh