数学原理解释resnet缓解梯度弥散问题

2023-11-10 02:20

本文主要是介绍数学原理解释resnet缓解梯度弥散问题,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

数学原理解释resnet缓解梯度弥散问题

  • 前言
    • 产生梯度弥散的原因
    • 残差结构
    • 激活函数缓解梯度弥散
    • 总结

前言

本文是一位职场小白在百度实习面试被虐,发现基本的大公司都会问到网络的数学原理解释,之后学习很多的博客。对残差网络的一些深入理解,开始写人生的第一篇博客,如有差错,还请各位大佬多多指正,多多交流

产生梯度弥散的原因

深度学习的本质是找到一个复杂的函数来拟合输入数据和输出数据之前的转换关系。简单的说:y = f(x),这里的x和y可能是向量,也可能是矩阵。复杂的网络就是函数f。

在深度学习中常见预处理:去均值,归一化。这样做的原因是能够使输入的数据之间方差更小,通俗的将就是每一次输入的数据都比较一致,模型就能够更快的收敛。也就是更快的学习到x——》y之间的转换关系f。达到类似效果的有初始化(xavier,何凯明),batch_normalization。

讲了以上怎么多关键引出的就是神经网络中流动的数据大多是均值为0,方差为1的数据分布。而神经网路的学习过程就是进行链式求导,这个不熟悉的话,想必大家都知道高中学习的符合函数求导吧 。原理是一样的,这样多个0-1之间的数字相乘就会越乘越小,导致梯度->0

残差结构

在上面的段落我们讲过,梯度弥散本质的原因是多个0-1之间小数相乘的结果。很简单的思维就是我们其中的一些数字变大,从0.1增大到0.9,类似于这种的操作。不就可以缓解了吗?

是的,残差网络就是怎么简单的原因,下面通过一个例子来更清晰的了解:

此时我们对权重w2进行求导梯度值为 y1+x,相比不加残差结构在梯度值上多加了一个x,达到了0.1到0.9的变化,因此在一定程度上缓解了梯度弥散的问题
此时我们对权重w2进行求导梯度值为 y1+x,相比不加残差结构在梯度值上多加了一个x,达到了0.1到0.9的变化,因此在一定程度上缓解了梯度弥散的问题

至于为什么不直接从0.1增大到9,个人觉得是数据的分布更离散,模型学习的会更困难, 收敛速度更慢。

激活函数缓解梯度弥散

在神经网络初期的时候使用的激活函数都是sigmoid激活,而sigmoid的梯度值在[4,+∞],[-∞,-4这两个区间趋近与0。所以后期有更换relu激活函数来缓解这个问题,我觉得目前用这个来回答不是很合理,上文也提起过,后来提出的BN,xavier初始化等方法都会将输出的数据分布调整为正太分布,而sigmoid 在0之间的梯度值接近线性函数的梯度值

总结

所以综上所述,对于梯度弥散的问题,残差结构是最直接的解决办法,而激活函数要针对于具体的数据分布

这篇关于数学原理解释resnet缓解梯度弥散问题的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/379854

相关文章

解决IDEA报错:编码GBK的不可映射字符问题

《解决IDEA报错:编码GBK的不可映射字符问题》:本文主要介绍解决IDEA报错:编码GBK的不可映射字符问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录IDEA报错:编码GBK的不可映射字符终端软件问题描述原因分析解决方案方法1:将命令改为方法2:右下jav

MyBatis模糊查询报错:ParserException: not supported.pos 问题解决

《MyBatis模糊查询报错:ParserException:notsupported.pos问题解决》本文主要介绍了MyBatis模糊查询报错:ParserException:notsuppo... 目录问题描述问题根源错误SQL解析逻辑深层原因分析三种解决方案方案一:使用CONCAT函数(推荐)方案二:

Redis 热 key 和大 key 问题小结

《Redis热key和大key问题小结》:本文主要介绍Redis热key和大key问题小结,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录一、什么是 Redis 热 key?热 key(Hot Key)定义: 热 key 常见表现:热 key 的风险:二、

IntelliJ IDEA 中配置 Spring MVC 环境的详细步骤及问题解决

《IntelliJIDEA中配置SpringMVC环境的详细步骤及问题解决》:本文主要介绍IntelliJIDEA中配置SpringMVC环境的详细步骤及问题解决,本文分步骤结合实例给大... 目录步骤 1:创建 Maven Web 项目步骤 2:添加 Spring MVC 依赖1、保存后执行2、将新的依赖

Spring 中的循环引用问题解决方法

《Spring中的循环引用问题解决方法》:本文主要介绍Spring中的循环引用问题解决方法,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录什么是循环引用?循环依赖三级缓存解决循环依赖二级缓存三级缓存本章来聊聊Spring 中的循环引用问题该如何解决。这里聊

Spring Boot中JSON数值溢出问题从报错到优雅解决办法

《SpringBoot中JSON数值溢出问题从报错到优雅解决办法》:本文主要介绍SpringBoot中JSON数值溢出问题从报错到优雅的解决办法,通过修改字段类型为Long、添加全局异常处理和... 目录一、问题背景:为什么我的接口突然报错了?二、为什么会发生这个错误?1. Java 数据类型的“容量”限制

关于MongoDB图片URL存储异常问题以及解决

《关于MongoDB图片URL存储异常问题以及解决》:本文主要介绍关于MongoDB图片URL存储异常问题以及解决方案,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐... 目录MongoDB图片URL存储异常问题项目场景问题描述原因分析解决方案预防措施js总结MongoDB图

SpringBoot项目中报错The field screenShot exceeds its maximum permitted size of 1048576 bytes.的问题及解决

《SpringBoot项目中报错ThefieldscreenShotexceedsitsmaximumpermittedsizeof1048576bytes.的问题及解决》这篇文章... 目录项目场景问题描述原因分析解决方案总结项目场景javascript提示:项目相关背景:项目场景:基于Spring

解决Maven项目idea找不到本地仓库jar包问题以及使用mvn install:install-file

《解决Maven项目idea找不到本地仓库jar包问题以及使用mvninstall:install-file》:本文主要介绍解决Maven项目idea找不到本地仓库jar包问题以及使用mvnin... 目录Maven项目idea找不到本地仓库jar包以及使用mvn install:install-file基

usb接口驱动异常问题常用解决方案

《usb接口驱动异常问题常用解决方案》当遇到USB接口驱动异常时,可以通过多种方法来解决,其中主要就包括重装USB控制器、禁用USB选择性暂停设置、更新或安装新的主板驱动等... usb接口驱动异常怎么办,USB接口驱动异常是常见问题,通常由驱动损坏、系统更新冲突、硬件故障或电源管理设置导致。以下是常用解决