13.3 Spark调优-JVM调优,shuffle调优, Reduce OOM

2024-06-07 19:08

本文主要是介绍13.3 Spark调优-JVM调优,shuffle调优, Reduce OOM,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

JVM调优:

Executor JVM堆内存 分为三块 静态资源划分

(60%(RDD以及广播变量存储的位置)+20%(运行内存)+20%(reduce 聚合内存))*90%+10%(JVM自身预留) = JVM堆内存

JVM的gc回收流程(属于运行内存中):

在task中创建出来的对象首先往eden和survior1种存放,survior2是空闲的。当eden和survior1区域放满以后就会触发minor gc(小型垃圾回收),清理掉不再使用的对象(死亡)。

会将存活下来的对象放入survior2中,如果存活下来的对象大于survior2的大小,那么JVM就会通过担保机制将多余的对象直接放入到老年代中。

如果这个时候年轻代的内存不是很大的话就会经常的进行minor gc(小型垃圾回收),频繁的minor gc会导致这段时间内有些存活的对象(多次垃圾回收都没有回收掉,一直在用又不能被释放)频繁的倒来倒去,会导致这些短生命周期的对象(不一定长期使用)每进行一次垃圾回收就会长一岁,年龄过大默认15岁,垃圾回收还是没有回收回去的就会跑到老年代里面去。

就会导致老年代中存放大量的短生命周期的对象,老年代应该存放的是数量比较少并且长期使用的对象,比如数据库连接池。这样的话,老年代就会溢满,触发full gc,因为本来老年代中的对象很少,很少进行full gc因此采取了不太复杂但消耗性能和时间的垃圾回收算法。

不管minor gc还是full gc都会导致JVM的工作线程停止

 

总结:堆内内存不足造成的影响

1,频繁的minor gc

2,老年代大量的短生命周期的对象会导致full gc

3,有了gc 就会影响Spark的性能和运行速度

增加内存或者提高运行内存比例解决频繁gc

还有一种方案:

统一的内存管理:JVM堆内存-300M

运行内存 占剩余内存的50%

存储内存 占剩余内存的50%

运行内存和存储内存可互相借用


Shuffle的调优

1、buffer的大小 32k

2、reduce task拉数据 3s 5次

3、hashShuffle 合并机制

4、每次拉取的数据量

5、reduce 聚合的内存比例

6、bypass 机制

7、spark.shuffle.manager sort 选用哪种shuffle

shuffle file connot find(磁盘小文件找不到的原因)?

Executor挂掉:

堆内内不足 --executor-memory 10G

堆外内存不足 shuffle有数据传输,netty 内部封装的是java NIO,是零拷贝,拷贝到堆外内存中

默认是这个Executor内存的10%

2G * 10% = 200M

如何调整堆外内存?

yarn:

--conf spark.yarn.executor.memoryOverhead=2048

standalone:

--conf spark.executor.memoryOverhead=2048

注意事项:

spark-submit脚本里面,去用--conf的方式,去添加配置

Executor没有挂掉:

建立通信失败:

如何提高建立通信的等待时间

--conf spark.core.connection.ack.wait.timeout=60s

注意事项:

spark-submit脚本里面,去用--conf的方式,去添加配置

数据传输的过程

暂时不知道


reduce oom问题

1,map端的map task计算完成后会将task计算的结果根据分区器的策略写入到磁盘小文件中

2,reduce端聚合的时候,会产生5个拉取数据的子线程,每次总共拉取48M的数据,reduce task来执行计算这些数据,默认reduce task端占20%的执行内存,当执行速度小于拉取速度时就会产生reduce oom

 

解决办法:

1,每次拉取数据从48M减少至24M

2,增加worker中的内存或者聚合比例 spark.shuffle.memoryFraction

这篇关于13.3 Spark调优-JVM调优,shuffle调优, Reduce OOM的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!


原文地址:
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.chinasem.cn/article/1040037

相关文章

Java通过驱动包(jar包)连接MySQL数据库的步骤总结及验证方式

《Java通过驱动包(jar包)连接MySQL数据库的步骤总结及验证方式》本文详细介绍如何使用Java通过JDBC连接MySQL数据库,包括下载驱动、配置Eclipse环境、检测数据库连接等关键步骤,... 目录一、下载驱动包二、放jar包三、检测数据库连接JavaJava 如何使用 JDBC 连接 mys

SpringBoot线程池配置使用示例详解

《SpringBoot线程池配置使用示例详解》SpringBoot集成@Async注解,支持线程池参数配置(核心数、队列容量、拒绝策略等)及生命周期管理,结合监控与任务装饰器,提升异步处理效率与系统... 目录一、核心特性二、添加依赖三、参数详解四、配置线程池五、应用实践代码说明拒绝策略(Rejected

一文详解SpringBoot中控制器的动态注册与卸载

《一文详解SpringBoot中控制器的动态注册与卸载》在项目开发中,通过动态注册和卸载控制器功能,可以根据业务场景和项目需要实现功能的动态增加、删除,提高系统的灵活性和可扩展性,下面我们就来看看Sp... 目录项目结构1. 创建 Spring Boot 启动类2. 创建一个测试控制器3. 创建动态控制器注

Java操作Word文档的全面指南

《Java操作Word文档的全面指南》在Java开发中,操作Word文档是常见的业务需求,广泛应用于合同生成、报表输出、通知发布、法律文书生成、病历模板填写等场景,本文将全面介绍Java操作Word文... 目录简介段落页头与页脚页码表格图片批注文本框目录图表简介Word编程最重要的类是org.apach

Spring Boot中WebSocket常用使用方法详解

《SpringBoot中WebSocket常用使用方法详解》本文从WebSocket的基础概念出发,详细介绍了SpringBoot集成WebSocket的步骤,并重点讲解了常用的使用方法,包括简单消... 目录一、WebSocket基础概念1.1 什么是WebSocket1.2 WebSocket与HTTP

SpringBoot+Docker+Graylog 如何让错误自动报警

《SpringBoot+Docker+Graylog如何让错误自动报警》SpringBoot默认使用SLF4J与Logback,支持多日志级别和配置方式,可输出到控制台、文件及远程服务器,集成ELK... 目录01 Spring Boot 默认日志框架解析02 Spring Boot 日志级别详解03 Sp

java中反射Reflection的4个作用详解

《java中反射Reflection的4个作用详解》反射Reflection是Java等编程语言中的一个重要特性,它允许程序在运行时进行自我检查和对内部成员(如字段、方法、类等)的操作,本文将详细介绍... 目录作用1、在运行时判断任意一个对象所属的类作用2、在运行时构造任意一个类的对象作用3、在运行时判断

java如何解压zip压缩包

《java如何解压zip压缩包》:本文主要介绍java如何解压zip压缩包问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Java解压zip压缩包实例代码结果如下总结java解压zip压缩包坐在旁边的小伙伴问我怎么用 java 将服务器上的压缩文件解压出来,

SpringBoot中SM2公钥加密、私钥解密的实现示例详解

《SpringBoot中SM2公钥加密、私钥解密的实现示例详解》本文介绍了如何在SpringBoot项目中实现SM2公钥加密和私钥解密的功能,通过使用Hutool库和BouncyCastle依赖,简化... 目录一、前言1、加密信息(示例)2、加密结果(示例)二、实现代码1、yml文件配置2、创建SM2工具

Spring WebFlux 与 WebClient 使用指南及最佳实践

《SpringWebFlux与WebClient使用指南及最佳实践》WebClient是SpringWebFlux模块提供的非阻塞、响应式HTTP客户端,基于ProjectReactor实现,... 目录Spring WebFlux 与 WebClient 使用指南1. WebClient 概述2. 核心依