java内存溢出的排查记录

2024-08-31 20:48
文章标签 java 内存 记录 排查 溢出

本文主要是介绍java内存溢出的排查记录,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

问题

     背景:服务异常,交易无法发到服务器,经排查发现大量SYN_RECV,重启服务后交易正常。有大量CLOSE_WAIT、SYN_RECV连接,交易日志无增量输出,每次重启后不久服务又出现无法访问现象,反复重启3次后,截止发邮件时生产上仍有CLOSE_WAIT,CLOSE_WAIT、SYN_RECV许多连接为F5地址,怀疑可能由F5引起大量非正常连接,进而导致交易无法正常使用。console.log中出现java.lang.OutOfMemoryError

问题排查及分析

  1. 收集相关信息。确认异常,明确现象: 
    1. 大量close_wait:根据TCP三次握手建立通讯可以知道,这个一般是在服务端出现的。排除恶意攻击的情况,只会在客户端断开链接之后服务端未及时关闭链接时出现;具体流程见相关文章
    2. 内存溢出:java.lang.OutOfMemoryError: Java heap space ;该异常为内存不足,一般是程序问题导致的。
    3. 在JVM参数中新增下列参数,在JVM虚拟机发生内存溢出异常时,自动产生DUMP文件
    4. #当应用抛出 OutOfMemoryError 时自动生成dump文件

      -XX:+HeapDumpOnOutOfMemoryError

      #dump文件输出路径

      -XX:HeapDumpPath=/home/sunefrs/sunefrs.dump

    5. 从dump文件上看,Log4j占用了大量内存.其回根收节点见下图
  2. 分析当前可能引起异常现象的可能原因:
    1. 生产日志量很大,大部分为图片比对交易,交易报文一般在几百K到1、2M不等,暂未发现超大报文的情况。
    2. 有大量F5调用异常。
    3. dump文件显示:有大量内存被log4j占用了。很可能是因为日志打印问题。
  3. 确认可能原因是否成立:
    1. F5正常。不太可能是F5造成的
    2. 日志量很大,从dump文件分析有极大可能是由于log4j打印日志造成的
  4. 复现生产问题步骤:
    1. 使用jmeter进行压测。使用大报文模拟交易。
    2. 打开java visualVm 监控内存使用情况
    3. 打开console.log监控控制台日志
    4. 使用netstat命令监控close_wait情况【此处不放截图,仅说结论】:
      1. 60并发压测:屏蔽日志打印,垃圾回收正常,交易未出现问题
      2. 60并发压测:不屏蔽日志打印,垃圾无法及时回收,交易OOM,并出现大量close_wait【之前测试没出现是因为设置了Keep-Alive参数
  5. 问题原因分析:
    1. 从业务日志上看,交易报文比较大,在日志打印的时候会把字段打印出来如下:日志量将会是8倍,如果是2M图片,会写16M以上日志【这里取值有点问题,正常生成是会写8倍日志的】【补充说明:实际上还有16进制的日志打印也会有2次,比原图片还大的多图片未写出来】
    2. 再看log4j配置文件:日志是异步打印的。当交易量较大的时候。日志打印量会超级大,假设每次报文图片大小为2M,有每分钟20个请求,每分钟就会有320M以上的日志量。且目前生产log4j配置为两处输出,因此日志量*2也就是640M以上,加上其他交易的日志,日志量会非常大。
      【测试环境写磁盘速度大约为87.2MB/sec,考虑到还有日志压缩和其他系统的读写,程序写日志不会把写磁盘速度用满。因此会有大量日志停留在内存中。因此会造成内存溢出。内存溢出后程序直接卡死,不能正常处理交易且无法恢复】
  6. 验证分析:
    1. 单线程且间隔较大时间调用交易:交易正常内存正常回收
    2. 高并发调用交易:程序快速内存溢出
    3. 关闭日志:高并发内存快速释放,交易正常 

总结

         内存溢出原因为:日志打印量过大,占用了过多磁盘资源,写日志的速度跟不上新增待写日志速度导致。

         查内存溢出最重要的就是要找到是什么类占用了内存,为什么不能正常释放。明确了这两点。内存溢出问题就不难解决。

解决方案

  1. 推荐方案:使用log4j过滤器,屏蔽图片字段相关打印。移除多余的日志打
  2. 可选方案:分多个jvm处理类似大报文的交易,把这个jvm的log4j文件直接屏蔽日志。
  3. 可选方案:修改底层代码,调整日志打印方式。

参考文章

  1. TCP状态变更流程:https://www.cnblogs.com/qingergege/p/6603488.html

这篇关于java内存溢出的排查记录的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1124957

相关文章

一文详解如何在idea中快速搭建一个Spring Boot项目

《一文详解如何在idea中快速搭建一个SpringBoot项目》IntelliJIDEA作为Java开发者的‌首选IDE‌,深度集成SpringBoot支持,可一键生成项目骨架、智能配置依赖,这篇文... 目录前言1、创建项目名称2、勾选需要的依赖3、在setting中检查maven4、编写数据源5、开启热

C++高效内存池实现减少动态分配开销的解决方案

《C++高效内存池实现减少动态分配开销的解决方案》C++动态内存分配存在系统调用开销、碎片化和锁竞争等性能问题,内存池通过预分配、分块管理和缓存复用解决这些问题,下面就来了解一下... 目录一、C++内存分配的性能挑战二、内存池技术的核心原理三、主流内存池实现:TCMalloc与Jemalloc1. TCM

Python UV安装、升级、卸载详细步骤记录

《PythonUV安装、升级、卸载详细步骤记录》:本文主要介绍PythonUV安装、升级、卸载的详细步骤,uv是Astral推出的下一代Python包与项目管理器,主打单一可执行文件、极致性能... 目录安装检查升级设置自动补全卸载UV 命令总结 官方文档详见:https://docs.astral.sh/

Java对异常的认识与异常的处理小结

《Java对异常的认识与异常的处理小结》Java程序在运行时可能出现的错误或非正常情况称为异常,下面给大家介绍Java对异常的认识与异常的处理,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参... 目录一、认识异常与异常类型。二、异常的处理三、总结 一、认识异常与异常类型。(1)简单定义-什么是

SpringBoot项目配置logback-spring.xml屏蔽特定路径的日志

《SpringBoot项目配置logback-spring.xml屏蔽特定路径的日志》在SpringBoot项目中,使用logback-spring.xml配置屏蔽特定路径的日志有两种常用方式,文中的... 目录方案一:基础配置(直接关闭目标路径日志)方案二:结合 Spring Profile 按环境屏蔽关

Java使用HttpClient实现图片下载与本地保存功能

《Java使用HttpClient实现图片下载与本地保存功能》在当今数字化时代,网络资源的获取与处理已成为软件开发中的常见需求,其中,图片作为网络上最常见的资源之一,其下载与保存功能在许多应用场景中都... 目录引言一、Apache HttpClient简介二、技术栈与环境准备三、实现图片下载与保存功能1.

SpringBoot排查和解决JSON解析错误(400 Bad Request)的方法

《SpringBoot排查和解决JSON解析错误(400BadRequest)的方法》在开发SpringBootRESTfulAPI时,客户端与服务端的数据交互通常使用JSON格式,然而,JSON... 目录问题背景1. 问题描述2. 错误分析解决方案1. 手动重新输入jsON2. 使用工具清理JSON3.

java中long的一些常见用法

《java中long的一些常见用法》在Java中,long是一种基本数据类型,用于表示长整型数值,接下来通过本文给大家介绍java中long的一些常见用法,感兴趣的朋友一起看看吧... 在Java中,long是一种基本数据类型,用于表示长整型数值。它的取值范围比int更大,从-922337203685477

java Long 与long之间的转换流程

《javaLong与long之间的转换流程》Long类提供了一些方法,用于在long和其他数据类型(如String)之间进行转换,本文将详细介绍如何在Java中实现Long和long之间的转换,感... 目录概述流程步骤1:将long转换为Long对象步骤2:将Longhttp://www.cppcns.c

SpringBoot集成LiteFlow实现轻量级工作流引擎的详细过程

《SpringBoot集成LiteFlow实现轻量级工作流引擎的详细过程》LiteFlow是一款专注于逻辑驱动流程编排的轻量级框架,它以组件化方式快速构建和执行业务流程,有效解耦复杂业务逻辑,下面给大... 目录一、基础概念1.1 组件(Component)1.2 规则(Rule)1.3 上下文(Conte