详解卷积神经网络(Convolutional Neural Networks, CNNs)

2023-12-05 06:36

本文主要是介绍详解卷积神经网络(Convolutional Neural Networks, CNNs),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

全连接神经网络基础

全连接神经网络(Fully Connected Neural Network 或 Multi-Layer Perceptron, MLP)是最简单的深度学习模型之一。一个典型的全连接网络由多个层组成,每一层包含多个神经元或节点。每个神经元与上一层的所有神经元相连,并通过激活函数产生输出。

全连接网络的每一层都执行以下操作:

  1. 接收来自上一层(或输入层)的输入。
  2. 将输入与该层的权重进行矩阵相乘。
  3. 加上一定的偏置项。
  4. 通过激活函数生成激活值。

在传统的全连接网络中,最常见的激活函数是Sigmoid、Tanh、ReLU等。

为什么全连接神经网络是卷积神经网络的基础?

全连接神经网络是理解复杂网络结构的基础。它教会我们如何堆叠层,如何通过反向传播调整权重,以及如何利用激活函数引入非线性。这些基础概念在卷积神经网络中同样适用。

卷积神经网络(Convolutional Neural Networks, CNNs)

卷积神经网络是专门用来处理具有网格结构输入的神经网络,例如图像(2D网格),声音信号(1D网格)等。CNN通过引入卷积层显著减少了模型参数的数量,并能够学习输入数据的局部特征。

卷积层 (Convolutional Layer)

卷积层通过一组可学习的卷积核(也称为过滤器或特征检测器)来提取特征。每个卷积核在输入图像上滑动(或卷积操作),并生成特征图(也称为激活图)。这允许网络专注于图像的局部信息,并且具有平移不变性。

池化层(Pooling Layer)

池化层通常位于连续的卷积层之间,用于降低特征图的空间维度,增强网络对小的变化的不变性,并减少计算量。最常见的池化操作是最大池化,它从覆盖的区域中提取最大值。

全连接层(Fully Connected Layer)

全连接层通常位于CNN的末尾,它们的作用是将前面卷积层和池化层学习到的局部特征组合起来完成特定的任务,比如分类。

激活函数

像全连接网络一样,CNN的卷积层和全连接层之后也会跟有激活函数,ReLU是现代CNNs中最常用的激活函数之一,因为它能够加速训练且防止梯度消失问题。

使用PyTorch搭建卷积神经网络

PyTorch是一个流行的开源机器学习库,尤其在研究领域受到青睐。下面是一个使用PyTorch搭建简单卷积神经网络的示例代码,带有详细的中文注释:

import torch
import torch.nn as nn
import torch.nn.functional as F# 定义CNN模型的类
class SimpleCNN(nn.Module):def __init__(self):super(SimpleCNN, self).__init__()# 卷积层1,使用了32个3x3的卷积核self.conv1 = nn.Conv2d(in_channels=1, out_channels=32, kernel_size=3, padding=1)# 卷积层2,使用了64个3x3的卷积核self.conv2 = nn.Conv2d(32, 64, 3, padding=1)# 最大池化层,使用了2x2的池化窗口self.pool = nn.MaxPool2d(kernel_size=2, stride=2)# 全连接层1,输入特征数量必须与前一层的输出相匹配# 这里的输入特征数量视乎前面层数和池化后的结果而定self.fc1 = nn.Linear(64 * 7 * 7, 128)# 全连接层2,用作输出层,假设我们要分类10个类别self.fc2 = nn.Linear(128, 10)# 定义前向传播路径def forward(self, x):# 经过第一个卷积层后使用ReLU激活函数x = F.relu(self.conv1(x))# 经过最大池化层x = self.pool(x)# 经过第二个卷积层后使用ReLU激活函数x = F.relu(self.conv2(x))# 经过最大池化层x = self.pool(x)# 将多维数据展平为一维,准备输入全连接层x = x.view(-1, 64 * 7 * 7)# 经过第一个全连接层后使用ReLU激活函数x = F.relu(self.fc1(x))# 经过输出层,并不使用激活函数,因为这里输出的是分类结果x = self.fc2(x)return x# 创建模型实例
model = SimpleCNN()# 打印模型结构
print(model)

以上代码中,我们构建了一个简单的卷积神经网络,它有2个卷积层,2个池化层以及完全连接的层。在实践中,您可能需要根据输入数据的大小和目标任务调整网络的大小和复杂性。例如,如果您处理的是更高分辨率的图像,您可能需要更多的卷积层或者更大的全连接层。

请注意,在实际应用中搭建CNN时,计算输入特征数量给全连接层是一个重要步骤,需要根据您的输入数据和之前层的设置来手动计算。例如,在上面的代码中,逻辑是假设输入的图像大小是28x28像素,经过两次2x2的池化后,其大小变为7x7像素(原大小除以池化窗口stride的大小的平方),因此在全连接层fc1中的输入特征数量必须设置为64(第二个卷积层的输出通道数)乘以7乘以7(池化后的图像大小)。

如果你想更深入地了解人工智能的其他方面,比如机器学习、深度学习、自然语言处理等等,也可以点击这个链接,我按照如下图所示的学习路线为大家整理了100多G的学习资源,基本涵盖了人工智能学习的所有内容,包括了目前人工智能领域最新顶会论文合集和丰富详细的项目实战资料,可以帮助你入门和进阶。

链接: 人工智能交流群【最新顶会与项目实战】(点击跳转)

在这里插入图片描述

这篇关于详解卷积神经网络(Convolutional Neural Networks, CNNs)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/456543

相关文章

一文深入详解Python的secrets模块

《一文深入详解Python的secrets模块》在构建涉及用户身份认证、权限管理、加密通信等系统时,开发者最不能忽视的一个问题就是“安全性”,Python在3.6版本中引入了专门面向安全用途的secr... 目录引言一、背景与动机:为什么需要 secrets 模块?二、secrets 模块的核心功能1. 基

一文详解MySQL如何设置自动备份任务

《一文详解MySQL如何设置自动备份任务》设置自动备份任务可以确保你的数据库定期备份,防止数据丢失,下面我们就来详细介绍一下如何使用Bash脚本和Cron任务在Linux系统上设置MySQL数据库的自... 目录1. 编写备份脚本1.1 创建并编辑备份脚本1.2 给予脚本执行权限2. 设置 Cron 任务2

一文详解如何在idea中快速搭建一个Spring Boot项目

《一文详解如何在idea中快速搭建一个SpringBoot项目》IntelliJIDEA作为Java开发者的‌首选IDE‌,深度集成SpringBoot支持,可一键生成项目骨架、智能配置依赖,这篇文... 目录前言1、创建项目名称2、勾选需要的依赖3、在setting中检查maven4、编写数据源5、开启热

Python常用命令提示符使用方法详解

《Python常用命令提示符使用方法详解》在学习python的过程中,我们需要用到命令提示符(CMD)进行环境的配置,:本文主要介绍Python常用命令提示符使用方法的相关资料,文中通过代码介绍的... 目录一、python环境基础命令【Windows】1、检查Python是否安装2、 查看Python的安

HTML5 搜索框Search Box详解

《HTML5搜索框SearchBox详解》HTML5的搜索框是一个强大的工具,能够有效提升用户体验,通过结合自动补全功能和适当的样式,可以创建出既美观又实用的搜索界面,这篇文章给大家介绍HTML5... html5 搜索框(Search Box)详解搜索框是一个用于输入查询内容的控件,通常用于网站或应用程

Python中使用uv创建环境及原理举例详解

《Python中使用uv创建环境及原理举例详解》uv是Astral团队开发的高性能Python工具,整合包管理、虚拟环境、Python版本控制等功能,:本文主要介绍Python中使用uv创建环境及... 目录一、uv工具简介核心特点:二、安装uv1. 通过pip安装2. 通过脚本安装验证安装:配置镜像源(可

C++ 函数 strftime 和时间格式示例详解

《C++函数strftime和时间格式示例详解》strftime是C/C++标准库中用于格式化日期和时间的函数,定义在ctime头文件中,它将tm结构体中的时间信息转换为指定格式的字符串,是处理... 目录C++ 函数 strftipythonme 详解一、函数原型二、功能描述三、格式字符串说明四、返回值五

LiteFlow轻量级工作流引擎使用示例详解

《LiteFlow轻量级工作流引擎使用示例详解》:本文主要介绍LiteFlow是一个灵活、简洁且轻量的工作流引擎,适合用于中小型项目和微服务架构中的流程编排,本文给大家介绍LiteFlow轻量级工... 目录1. LiteFlow 主要特点2. 工作流定义方式3. LiteFlow 流程示例4. LiteF

CSS3中的字体及相关属性详解

《CSS3中的字体及相关属性详解》:本文主要介绍了CSS3中的字体及相关属性,详细内容请阅读本文,希望能对你有所帮助... 字体网页字体的三个来源:用户机器上安装的字体,放心使用。保存在第三方网站上的字体,例如Typekit和Google,可以link标签链接到你的页面上。保存在你自己Web服务器上的字

MySQL存储过程之循环遍历查询的结果集详解

《MySQL存储过程之循环遍历查询的结果集详解》:本文主要介绍MySQL存储过程之循环遍历查询的结果集,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录前言1. 表结构2. 存储过程3. 关于存储过程的SQL补充总结前言近来碰到这样一个问题:在生产上导入的数据发现