解决Keras下训练CNN模型时,Loss值不断增大问题

2023-11-25 06:50

本文主要是介绍解决Keras下训练CNN模型时,Loss值不断增大问题,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

背景

在服务器上训练用keras写的Lenet5的CNN分类模型过程中,发现训练一开始训练的loss值、测试的loss值都在不断增大。如下图:(值大到吐血)
在这里插入图片描述
于是乎,开始心酸找bug历程(暴哭)

解决过程

1.通常先查看数据集。图像和标签是否对应。没问题(√)
2.模型结构问题,特别是最后输出时种类个数对不对。没问题(√)
3.权重初始化问题。训练之前模型自动初始化。没问题(√)
4.选择合适的激活函数(选的relu)、损失函数(交叉熵)、优化器(Adam)、学习率(初始0.0001,之后一定epoch后下降)。没问题(√)
5.我训练的数据是识别文本验证码,同时也检查了标签是否进行了one-hot编码。没问题(√)
6.老老实实看了遍全部代码。同样没问题(√)

在以上没问题的情况下,训练是loss值还是在不断增大。于是乎,我不知道该改什么了…就去找博士了…
首先博士看了遍代码。没有问题
在他电脑上(windows系统)运行,没有问题,loss值是在下降…
我愣住…同样的代码莫非我电脑自带bug???
最后发现是tensorflow版本问题!!
他的版本是1.19.0,我的是2.0.0
我…(一时语塞)

结论

1.如果遇到训练一开始loss值就增大问题,排除上面那几点外,看下运行的环境!!tensorflow的版本。
2.现在tensorflow版本没有1.19.0的了,我就安装了1.13.1的版本,python的版本是3.7.1。注意,在我windows上运行没有一点问题。
但当我将相同环境放到linux上运行时,就会报错:

ImportError:  /lib64/libm.so.6: version `GLIBC_2.23' not found

弄了半天安装glibc_2.23,结果最后只需要配了python==3.6版本的虚拟环境就正常了。原因可能是windows和linux所用到的C库可能不一样叭。

好了,总算是正常跑起来了的样子。(撒花)
在这里插入图片描述

后续

打扰了…训练的时候忘记安装gpu版本的tensorflow,就说怎么训练的这么慢…pip install tensorflow-gpu==version 安装对应版本的,我安装了1.8.0的。

这篇关于解决Keras下训练CNN模型时,Loss值不断增大问题的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/423306

相关文章

修改若依框架Token的过期时间问题

《修改若依框架Token的过期时间问题》本文介绍了如何修改若依框架中Token的过期时间,通过修改`application.yml`文件中的配置来实现,默认单位为分钟,希望此经验对大家有所帮助,也欢迎... 目录修改若依框架Token的过期时间修改Token的过期时间关闭Token的过期时js间总结修改若依

SpringBoot中的404错误:原因、影响及解决策略

《SpringBoot中的404错误:原因、影响及解决策略》本文详细介绍了SpringBoot中404错误的出现原因、影响以及处理策略,404错误常见于URL路径错误、控制器配置问题、静态资源配置错误... 目录Spring Boot中的404错误:原因、影响及处理策略404错误的出现原因1. URL路径错

如何在本地部署 DeepSeek Janus Pro 文生图大模型

《如何在本地部署DeepSeekJanusPro文生图大模型》DeepSeekJanusPro模型在本地成功部署,支持图片理解和文生图功能,通过Gradio界面进行交互,展示了其强大的多模态处... 目录什么是 Janus Pro1. 安装 conda2. 创建 python 虚拟环境3. 克隆 janus

本地私有化部署DeepSeek模型的详细教程

《本地私有化部署DeepSeek模型的详细教程》DeepSeek模型是一种强大的语言模型,本地私有化部署可以让用户在自己的环境中安全、高效地使用该模型,避免数据传输到外部带来的安全风险,同时也能根据自... 目录一、引言二、环境准备(一)硬件要求(二)软件要求(三)创建虚拟环境三、安装依赖库四、获取 Dee

MySQL的cpu使用率100%的问题排查流程

《MySQL的cpu使用率100%的问题排查流程》线上mysql服务器经常性出现cpu使用率100%的告警,因此本文整理一下排查该问题的常规流程,文中通过代码示例讲解的非常详细,对大家的学习或工作有一... 目录1. 确认CPU占用来源2. 实时分析mysql活动3. 分析慢查询与执行计划4. 检查索引与表

MySQL报错sql_mode=only_full_group_by的问题解决

《MySQL报错sql_mode=only_full_group_by的问题解决》本文主要介绍了MySQL报错sql_mode=only_full_group_by的问题解决,文中通过示例代码介绍的非... 目录报错信息DataGrip 报错还原Navicat 报错还原报错原因解决方案查看当前 sql mo

Spring Boot 整合 ShedLock 处理定时任务重复执行的问题小结

《SpringBoot整合ShedLock处理定时任务重复执行的问题小结》ShedLock是解决分布式系统中定时任务重复执行问题的Java库,通过在数据库中加锁,确保只有一个节点在指定时间执行... 目录前言什么是 ShedLock?ShedLock 的工作原理:定时任务重复执行China编程的问题使用 Shed

MYSQL事务死锁问题排查及解决方案

《MYSQL事务死锁问题排查及解决方案》:本文主要介绍Java服务报错日志的情况,并通过一系列排查和优化措施,最终发现并解决了服务假死的问题,文中通过代码介绍的非常详细,需要的朋友可以参考下... 目录问题现象推测 1 - 客户端无错误重试配置推测 2 - 客户端超时时间过短推测 3 - mysql 版本问

Git提交代码详细流程及问题总结

《Git提交代码详细流程及问题总结》:本文主要介绍Git的三大分区,分别是工作区、暂存区和版本库,并详细描述了提交、推送、拉取代码和合并分支的流程,文中通过代码介绍的非常详解,需要的朋友可以参考下... 目录1.git 三大分区2.Git提交、推送、拉取代码、合并分支详细流程3.问题总结4.git push

DeepSeek模型本地部署的详细教程

《DeepSeek模型本地部署的详细教程》DeepSeek作为一款开源且性能强大的大语言模型,提供了灵活的本地部署方案,让用户能够在本地环境中高效运行模型,同时保护数据隐私,在本地成功部署DeepSe... 目录一、环境准备(一)硬件需求(二)软件依赖二、安装Ollama三、下载并部署DeepSeek模型选