java内存溢出的排查记录

2024-08-31 20:48
文章标签 java 内存 记录 排查 溢出

本文主要是介绍java内存溢出的排查记录,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

问题

     背景:服务异常,交易无法发到服务器,经排查发现大量SYN_RECV,重启服务后交易正常。有大量CLOSE_WAIT、SYN_RECV连接,交易日志无增量输出,每次重启后不久服务又出现无法访问现象,反复重启3次后,截止发邮件时生产上仍有CLOSE_WAIT,CLOSE_WAIT、SYN_RECV许多连接为F5地址,怀疑可能由F5引起大量非正常连接,进而导致交易无法正常使用。console.log中出现java.lang.OutOfMemoryError

问题排查及分析

  1. 收集相关信息。确认异常,明确现象: 
    1. 大量close_wait:根据TCP三次握手建立通讯可以知道,这个一般是在服务端出现的。排除恶意攻击的情况,只会在客户端断开链接之后服务端未及时关闭链接时出现;具体流程见相关文章
    2. 内存溢出:java.lang.OutOfMemoryError: Java heap space ;该异常为内存不足,一般是程序问题导致的。
    3. 在JVM参数中新增下列参数,在JVM虚拟机发生内存溢出异常时,自动产生DUMP文件
    4. #当应用抛出 OutOfMemoryError 时自动生成dump文件

      -XX:+HeapDumpOnOutOfMemoryError

      #dump文件输出路径

      -XX:HeapDumpPath=/home/sunefrs/sunefrs.dump

    5. 从dump文件上看,Log4j占用了大量内存.其回根收节点见下图
  2. 分析当前可能引起异常现象的可能原因:
    1. 生产日志量很大,大部分为图片比对交易,交易报文一般在几百K到1、2M不等,暂未发现超大报文的情况。
    2. 有大量F5调用异常。
    3. dump文件显示:有大量内存被log4j占用了。很可能是因为日志打印问题。
  3. 确认可能原因是否成立:
    1. F5正常。不太可能是F5造成的
    2. 日志量很大,从dump文件分析有极大可能是由于log4j打印日志造成的
  4. 复现生产问题步骤:
    1. 使用jmeter进行压测。使用大报文模拟交易。
    2. 打开java visualVm 监控内存使用情况
    3. 打开console.log监控控制台日志
    4. 使用netstat命令监控close_wait情况【此处不放截图,仅说结论】:
      1. 60并发压测:屏蔽日志打印,垃圾回收正常,交易未出现问题
      2. 60并发压测:不屏蔽日志打印,垃圾无法及时回收,交易OOM,并出现大量close_wait【之前测试没出现是因为设置了Keep-Alive参数
  5. 问题原因分析:
    1. 从业务日志上看,交易报文比较大,在日志打印的时候会把字段打印出来如下:日志量将会是8倍,如果是2M图片,会写16M以上日志【这里取值有点问题,正常生成是会写8倍日志的】【补充说明:实际上还有16进制的日志打印也会有2次,比原图片还大的多图片未写出来】
    2. 再看log4j配置文件:日志是异步打印的。当交易量较大的时候。日志打印量会超级大,假设每次报文图片大小为2M,有每分钟20个请求,每分钟就会有320M以上的日志量。且目前生产log4j配置为两处输出,因此日志量*2也就是640M以上,加上其他交易的日志,日志量会非常大。
      【测试环境写磁盘速度大约为87.2MB/sec,考虑到还有日志压缩和其他系统的读写,程序写日志不会把写磁盘速度用满。因此会有大量日志停留在内存中。因此会造成内存溢出。内存溢出后程序直接卡死,不能正常处理交易且无法恢复】
  6. 验证分析:
    1. 单线程且间隔较大时间调用交易:交易正常内存正常回收
    2. 高并发调用交易:程序快速内存溢出
    3. 关闭日志:高并发内存快速释放,交易正常 

总结

         内存溢出原因为:日志打印量过大,占用了过多磁盘资源,写日志的速度跟不上新增待写日志速度导致。

         查内存溢出最重要的就是要找到是什么类占用了内存,为什么不能正常释放。明确了这两点。内存溢出问题就不难解决。

解决方案

  1. 推荐方案:使用log4j过滤器,屏蔽图片字段相关打印。移除多余的日志打
  2. 可选方案:分多个jvm处理类似大报文的交易,把这个jvm的log4j文件直接屏蔽日志。
  3. 可选方案:修改底层代码,调整日志打印方式。

参考文章

  1. TCP状态变更流程:https://www.cnblogs.com/qingergege/p/6603488.html

这篇关于java内存溢出的排查记录的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1124957

相关文章

一文详解SpringBoot中控制器的动态注册与卸载

《一文详解SpringBoot中控制器的动态注册与卸载》在项目开发中,通过动态注册和卸载控制器功能,可以根据业务场景和项目需要实现功能的动态增加、删除,提高系统的灵活性和可扩展性,下面我们就来看看Sp... 目录项目结构1. 创建 Spring Boot 启动类2. 创建一个测试控制器3. 创建动态控制器注

Java操作Word文档的全面指南

《Java操作Word文档的全面指南》在Java开发中,操作Word文档是常见的业务需求,广泛应用于合同生成、报表输出、通知发布、法律文书生成、病历模板填写等场景,本文将全面介绍Java操作Word文... 目录简介段落页头与页脚页码表格图片批注文本框目录图表简介Word编程最重要的类是org.apach

Spring Boot中WebSocket常用使用方法详解

《SpringBoot中WebSocket常用使用方法详解》本文从WebSocket的基础概念出发,详细介绍了SpringBoot集成WebSocket的步骤,并重点讲解了常用的使用方法,包括简单消... 目录一、WebSocket基础概念1.1 什么是WebSocket1.2 WebSocket与HTTP

SpringBoot+Docker+Graylog 如何让错误自动报警

《SpringBoot+Docker+Graylog如何让错误自动报警》SpringBoot默认使用SLF4J与Logback,支持多日志级别和配置方式,可输出到控制台、文件及远程服务器,集成ELK... 目录01 Spring Boot 默认日志框架解析02 Spring Boot 日志级别详解03 Sp

java中反射Reflection的4个作用详解

《java中反射Reflection的4个作用详解》反射Reflection是Java等编程语言中的一个重要特性,它允许程序在运行时进行自我检查和对内部成员(如字段、方法、类等)的操作,本文将详细介绍... 目录作用1、在运行时判断任意一个对象所属的类作用2、在运行时构造任意一个类的对象作用3、在运行时判断

java如何解压zip压缩包

《java如何解压zip压缩包》:本文主要介绍java如何解压zip压缩包问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Java解压zip压缩包实例代码结果如下总结java解压zip压缩包坐在旁边的小伙伴问我怎么用 java 将服务器上的压缩文件解压出来,

SpringBoot中SM2公钥加密、私钥解密的实现示例详解

《SpringBoot中SM2公钥加密、私钥解密的实现示例详解》本文介绍了如何在SpringBoot项目中实现SM2公钥加密和私钥解密的功能,通过使用Hutool库和BouncyCastle依赖,简化... 目录一、前言1、加密信息(示例)2、加密结果(示例)二、实现代码1、yml文件配置2、创建SM2工具

Spring WebFlux 与 WebClient 使用指南及最佳实践

《SpringWebFlux与WebClient使用指南及最佳实践》WebClient是SpringWebFlux模块提供的非阻塞、响应式HTTP客户端,基于ProjectReactor实现,... 目录Spring WebFlux 与 WebClient 使用指南1. WebClient 概述2. 核心依

Spring Boot @RestControllerAdvice全局异常处理最佳实践

《SpringBoot@RestControllerAdvice全局异常处理最佳实践》本文详解SpringBoot中通过@RestControllerAdvice实现全局异常处理,强调代码复用、统... 目录前言一、为什么要使用全局异常处理?二、核心注解解析1. @RestControllerAdvice2

Spring IoC 容器的使用详解(最新整理)

《SpringIoC容器的使用详解(最新整理)》文章介绍了Spring框架中的应用分层思想与IoC容器原理,通过分层解耦业务逻辑、数据访问等模块,IoC容器利用@Component注解管理Bean... 目录1. 应用分层2. IoC 的介绍3. IoC 容器的使用3.1. bean 的存储3.2. 方法注