本文主要是介绍显存充足但是CUDA out of Memory报错解决_查看僵尸进程,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!
首先排除了是batchsize太大的原因,我从16改到了1,还是一直在OOM,而且更重要的是,前一天还是能跑的,今天就跑不了了55。
然后突然想到是不是僵尸进程的原因,僵尸进程是不会显示在nvidia-smi里的
去网上搜了搜怎么看僵尸进程的方法:fuser -v /dev/nvidia*
这条命令用不用sudo都行。
我看了两次,真让我找到两个叛徒。nvidia-smi里面根本没有它们。kill掉之后终于能跑啦
-------------------------------一些碎碎念--------------------------
好久没写了咳咳。
以后大概不会继续写论文阅读了,之前刚开始读论文总感觉读不太懂,所以写一遍加深印象。
现在慢慢步入正轨了(主要还是懒,写下来真的好麻烦OO)
以后大概是bug解决居多吧()
这篇关于显存充足但是CUDA out of Memory报错解决_查看僵尸进程的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!