解决Keras下训练CNN模型时,Loss值不断增大问题

2023-11-25 06:50

本文主要是介绍解决Keras下训练CNN模型时,Loss值不断增大问题,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

背景

在服务器上训练用keras写的Lenet5的CNN分类模型过程中,发现训练一开始训练的loss值、测试的loss值都在不断增大。如下图:(值大到吐血)
在这里插入图片描述
于是乎,开始心酸找bug历程(暴哭)

解决过程

1.通常先查看数据集。图像和标签是否对应。没问题(√)
2.模型结构问题,特别是最后输出时种类个数对不对。没问题(√)
3.权重初始化问题。训练之前模型自动初始化。没问题(√)
4.选择合适的激活函数(选的relu)、损失函数(交叉熵)、优化器(Adam)、学习率(初始0.0001,之后一定epoch后下降)。没问题(√)
5.我训练的数据是识别文本验证码,同时也检查了标签是否进行了one-hot编码。没问题(√)
6.老老实实看了遍全部代码。同样没问题(√)

在以上没问题的情况下,训练是loss值还是在不断增大。于是乎,我不知道该改什么了…就去找博士了…
首先博士看了遍代码。没有问题
在他电脑上(windows系统)运行,没有问题,loss值是在下降…
我愣住…同样的代码莫非我电脑自带bug???
最后发现是tensorflow版本问题!!
他的版本是1.19.0,我的是2.0.0
我…(一时语塞)

结论

1.如果遇到训练一开始loss值就增大问题,排除上面那几点外,看下运行的环境!!tensorflow的版本。
2.现在tensorflow版本没有1.19.0的了,我就安装了1.13.1的版本,python的版本是3.7.1。注意,在我windows上运行没有一点问题。
但当我将相同环境放到linux上运行时,就会报错:

ImportError:  /lib64/libm.so.6: version `GLIBC_2.23' not found

弄了半天安装glibc_2.23,结果最后只需要配了python==3.6版本的虚拟环境就正常了。原因可能是windows和linux所用到的C库可能不一样叭。

好了,总算是正常跑起来了的样子。(撒花)
在这里插入图片描述

后续

打扰了…训练的时候忘记安装gpu版本的tensorflow,就说怎么训练的这么慢…pip install tensorflow-gpu==version 安装对应版本的,我安装了1.8.0的。

这篇关于解决Keras下训练CNN模型时,Loss值不断增大问题的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/423306

相关文章

Springboot3统一返回类设计全过程(从问题到实现)

《Springboot3统一返回类设计全过程(从问题到实现)》文章介绍了如何在SpringBoot3中设计一个统一返回类,以实现前后端接口返回格式的一致性,该类包含状态码、描述信息、业务数据和时间戳,... 目录Spring Boot 3 统一返回类设计:从问题到实现一、核心需求:统一返回类要解决什么问题?

解决idea启动项目报错java: OutOfMemoryError: insufficient memory

《解决idea启动项目报错java:OutOfMemoryError:insufficientmemory》:本文主要介绍解决idea启动项目报错java:OutOfMemoryError... 目录原因:解决:总结 原因:在Java中遇到OutOfMemoryError: insufficient me

maven异常Invalid bound statement(not found)的问题解决

《maven异常Invalidboundstatement(notfound)的问题解决》本文详细介绍了Maven项目中常见的Invalidboundstatement异常及其解决方案,文中通过... 目录Maven异常:Invalid bound statement (not found) 详解问题描述可

idea粘贴空格时显示NBSP的问题及解决方案

《idea粘贴空格时显示NBSP的问题及解决方案》在IDEA中粘贴代码时出现大量空格占位符NBSP,可以通过取消勾选AdvancedSettings中的相应选项来解决... 目录1、背景介绍2、解决办法3、处理完成总结1、背景介绍python在idehttp://www.chinasem.cna粘贴代码,出

SpringBoot整合Kafka启动失败的常见错误问题总结(推荐)

《SpringBoot整合Kafka启动失败的常见错误问题总结(推荐)》本文总结了SpringBoot项目整合Kafka启动失败的常见错误,包括Kafka服务器连接问题、序列化配置错误、依赖配置问题、... 目录一、Kafka服务器连接问题1. Kafka服务器无法连接2. 开发环境与生产环境网络不通二、序

SpringSecurity中的跨域问题处理方案

《SpringSecurity中的跨域问题处理方案》本文介绍了跨域资源共享(CORS)技术在JavaEE开发中的应用,详细讲解了CORS的工作原理,包括简单请求和非简单请求的处理方式,本文结合实例代码... 目录1.什么是CORS2.简单请求3.非简单请求4.Spring跨域解决方案4.1.@CrossOr

nacos服务无法注册到nacos服务中心问题及解决

《nacos服务无法注册到nacos服务中心问题及解决》本文详细描述了在Linux服务器上使用Tomcat启动Java程序时,服务无法注册到Nacos的排查过程,通过一系列排查步骤,发现问题出在Tom... 目录简介依赖异常情况排查断点调试原因解决NacosRegisterOnWar结果总结简介1、程序在

解决java.util.RandomAccessSubList cannot be cast to java.util.ArrayList错误的问题

《解决java.util.RandomAccessSubListcannotbecasttojava.util.ArrayList错误的问题》当你尝试将RandomAccessSubList... 目录Java.util.RandomAccessSubList cannot be cast to java.

Apache服务器IP自动跳转域名的问题及解决方案

《Apache服务器IP自动跳转域名的问题及解决方案》本教程将详细介绍如何通过Apache虚拟主机配置实现这一功能,并解决常见问题,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,... 目录​​问题背景​​解决方案​​方法 1:修改 httpd-vhosts.conf(推荐)​​步骤

java反序列化serialVersionUID不一致问题及解决

《java反序列化serialVersionUID不一致问题及解决》文章主要讨论了在Java中序列化和反序列化过程中遇到的问题,特别是当实体类的`serialVersionUID`发生变化或未设置时,... 目录前言一、序列化、反序列化二、解决方法总结前言serialVersionUID变化后,反序列化失