如何为Spark集群配置–num-executors, – executor-memory和–execuor-cores

本文探讨了在Spark集群中合理配置--num-executors、-executor-memory和–executor-cores的方法,通过对比三种不同的配置策略,分析了它们的优劣,旨在帮助读者理解如何平衡资源分配,以提高Spark作业的效率。

前言
在我们提交spark进程时,应该如何为Spark集群配置–num-executors, - executor-memory和–execuor-cores 呢?

一些资源参数设置的基本知识
  • Hadoop / Yarn / OS Deamons 当我们使用像Yarn这样的集群管理器运行spark应用进程时,会有几个守护进程在后台运行,如NameNode,Secondary NameNode,DataNode,JobTracker和TaskTracker等。因此,在指定num-executors时,我们需要确保为这些守护进程留下足够的核心(至少每个节点约1 CPU核)以便顺利运行。

  • Yarn ApplicationMaster(AM) ApplicationMaster负责协调来自ResourceManager的资源,并与NodeManagers一起执行container并监控其资源消耗。如果我们在YARN上运行Spark,那么我们需要预估运行AM所需要的资源(至少1024MB和1 CPU核)。

  • HDFS吞吐量 HDFS客户端遇到大量并发线程会出现一些bug。一般来说,每个executors最多可以实现5个任务的完全写入吞吐量,因此最好将每个executors的核心数保持在该数量之下。

  • MemoryOverhead JVM还需要一些off heap的内存,请参考下图中描绘的Spark和YARN中内存属性的层次结构,
    在这里插入图片描述
    简单来说,有以下两个公式:

每个executor从YARN请求的内存 = spark-executor-memory + spark.yarn.executor.memoryOverhead

spark.yarn.executor.memoryOverhead = Max(384MB, 7% of spark.executor-memory)
例如当我设置 --executor-memory=20时, 我们实际请求了
20GB + memoryOverhead = 20 + 7% of 20GB = ~23GB。

不同配置的优劣分析

现在,假设我们的集群配置如下

10 Nodes
16 cores per Node
64GB RAM per Node
第一种方法:使用较小的executors

--num-executors = 在这种方法中,我们将为每个核心分配一个executor
= 集群的总核心数
= 每个节点的核心数 * 集群的总节点数
= 16 x 10 = 160

--executor-cores = 1 (每个executor分配的核心数目)

--executor-memory = 每个executor分配的内存数
= 每个节点内存总数数/每个节点上分配的executor数
= 64GB/16 = 4GB

分析: 由于每个executor只分配了一个核,我们将无法利用在同一个JVM中运行多个任务的优点。 此外,共享/缓存变量(如广播变量和累加器)将在节点的每个核心中复制16次。 最严重的就是,我们没有为Hadoop / Yarn守护进程进程留下足够的内存开销,我们还忘记了将ApplicationManagers运行所需要的开销加入计算。

第二种方法:使用较大的executors

--num-executors = 在这种方法中,我们将为每个节点分配一个executor
= 集群的总节点数
= 10

--executor-cores = 每个节点一个executor意味着该节点的所有核心都分配给一个执executor
= 每个节点的总核心数
= 16

--executor-memory = 每个executor分配的内存数
= 每个节点内存总数数/每个节点上分配的executor数
= 64GB/1 = 64GB

分析: 每个executor都有16个核心,由于HDFS客户端遇到大量并发线程会出现一些bug,即HDFS吞吐量会受到影响。同时过大的内存分配也会导致过多的GC延迟。

第三种方法:使用优化的executors

基于上面提到的建议,让我们为每个执行器分配5个核心, 即–executor-cores = 5
为每个节点留出1个核心用于Hadoop / Yarn守护进程, 即每个节点可用的核心数 = 16-1 = 15。 因此,群集中核心的可用总数= 15 x 10 = 150

–num-executors =(群集中核心的可用总数/每个executors分配的核心数)= 150/5 = 30

为ApplicationManager留下预留1个executors的资源, 即–num-executors = 29
每个节点的executors数目 = 30/10 = 3

群集中每个节点的可使用的总内存数 64GB - 1GB = 63GB
每个executor的内存= 64GB / 3 = 21GB
预留的 off heap overhead = 21GB * 7% ~ 1.47G
所以,实际的–executor-memory = 21 - 1.47G ~ 19GB

参考

how-to-tune-your-apache-spark-jobs-part-2
distribution_of_executors_cores_and_memory_for_spark_application

内容概要:本文详细介绍了一种基于三电平ANPC-VSG(虚拟同步发电机)构网型逆变器的复合控制策略,聚焦于双闭环控制与中点电位平衡控制的实现,适用于光伏储能系统并网的Simulink仿真模型。该模型为未发表的原创研究成果,涵盖了逆变器在并网过程中的动态响应、稳定性控制以及中点电位的有效调节,旨在提升新能源并网系统的稳定性与电能质量。文中还探讨了多种相关控制技术,如DPWMA调制、正负序分离控制、前馈控制等,充分展现了该系统在复杂电网环境下的适应性与先进性。; 适合人群:面向具备电力电子、新能源并网或自动控制理论基础的科研人员与工程技术人员,特别适合从事光伏储能、虚拟同步机、三电平逆变器等相关课题研究的研究生、高校教师及企业研发工程师。; 使用场景及目标:①用于光伏储能系统并网仿真,验证VSG控制策略在动态响应与稳定性方面的有效性;②研究三电平ANPC逆变器在不平衡工况下的中点电位控制性能;③作为高级电力系统仿真的教学与科研平台,支撑学术论文撰写、项目申报及关键技术攻关。; 阅读建议:建议结合提供的Simulink仿真模型进行实践操作,重点剖析双闭环控制结构的设计原理与中点电位平衡机制的实现细节,同时参考文中提及的DPWMA调制与前馈控制等辅助策略,以拓宽研究视野与技术路径。完整资源可通过指定公众号或网盘链接获取。
内容概要:本文提出了一种含电动汽车、光伏发电储能系统的输配电网协同优化模型,聚焦于输电网与配电网之间的日前优化调度问题。该模型基于Matlab平台实现,通过整合多类型分布式能源的运行特性,实现源---储的协同调度,旨在提升电力系统运行的经济性、稳定性与灵活性。研究综合考虑了电动汽车的充电行为不确定性、光伏出力的波动性以及储能系统的充放电策略,采用先进的优化算法(如灰狼优化GWO、CEEMDAN等)进行求解,有效应对新能源接入带来的系统挑战。此外,文档还延伸介绍了多时间尺度优化、需求响应、碳约束、算力-电力-热力耦合等前沿研究方向,展现了该模型在综合能源系统与智能电网领域的广泛应用前景技术深度。; 适合人群:具备电力系统、能源工程、自动化或相关专业背景,熟悉Matlab/Simulink仿真环境,从事科研或工程应用的研究生、科研人员及工程师。; 使用场景及目标:①用于研究高比例可再生能源接入下的电网优化调度策略;②支撑电力系统中电动汽车、储能等灵活资源的协同管理与优化配置;③为综合能源系统、智能电网及低碳能源转型提供模型参考与代码实现基础。; 阅读建议:建议读者结合文中提及的优化算法(如GWO、CEEMDAN等)仿真工具,逐步复现模型,并根据实际应用场景调整参数、拓展模型结构,以深化对协同优化机制与综合能源系统运行规律的理解与应用。
内容概要:本文围绕三相并网逆变器的控制策略展开深入研究,重点探讨了虚拟阻抗与统一有源阻尼相结合的控制方法,并系统对比分析了SVPWM(空间矢量脉宽调制)与SPWM(正弦脉宽调制)在并网系统中的调制性能。通过MATLAB/Simulink平台构建仿真模型,验证了所提出控制策略在提升系统稳定性、抑制谐振振荡、改善并网电流波形质量等方面的优越性,尤其在弱电网条件下表现出较强的鲁棒性与适应能力。研究还进一步涵盖了多电平逆变器(如ANPC、T型三电平)的关键技术,包括中点电位平衡控制、低电压穿越(LVRT)能力提升、正负序分离控制以及电网前馈补偿等内容,体现了现代并网逆变器控制策略的综合性与先进性,为新能源并网系统的高性能运行提供了理论支持与技术路径。; 适合人群:具备电力电子、电气工程、新能源发电或电力系统自动化等相关专业背景的科研人员、硕士/博士研究生及工程技术人员,熟悉MATLAB/Simulink仿真环境,有志于从事并网逆变器控制、电能质量治理、可再生能源并网等方向的研究与开发工作。; 使用场景及目标:①用于三相并网逆变器控制系统的设计、优化与性能验证;②支撑科研项目中关于有源阻尼、虚拟阻抗、多电平调制等关键技术的仿真分析与实验验证;③作为高校电力电子与电力系统类课程的教学案例或毕业设计参考,提升学生对并网控制策略的理解与实践能力。; 阅读建议:建议结合文中所述Simulink仿真实例进行动手复现,重点关注不同调制方式(SVPWM/SPWM)下系统的动态响应与稳态性能差异,深入理解虚拟阻抗与有源阻尼的物理意义及其参数整定方法,同时可延伸学习虚拟同步发电机(VSG)、构网型控制(Grid-Forming)等前沿技术,以全面把握新型电力系统中逆变器的核心作用与发展趋势。
内容概要:本文深入研究了电力系统中三相并网逆变器的SVPWM与SPWM调制策略,重点探讨了基于虚拟阻抗与统一有源阻尼技术的控制方法,旨在提升逆变器在并网过程中的稳定性、抗干扰能力与动态响应性能。通过Simulink仿真平台,构建并验证了融合虚拟阻抗统一有源阻尼机制的逆变器控制系统模型,有效解决了由电网阻抗变化引发的谐振问题,显著增强了系统在弱电网条件下的适应性与鲁棒性。文章系统对比了SVPWM与SPWM两种调制方式在不同工况下的输出特性与控制效果,并通过详尽的仿真结果展示了所提策略在改善并网电流波形质量、抑制谐波畸变、提升系统稳定性方面的优越性。; 适合人群:具备扎实的电力电子与电力系统理论基础,熟练掌握Simulink仿真工具,从事新能源发电并网、逆变器先进控制策略研究或相关领域工作的研究生、科研人员及工程技术人员。; 使用场景及目标:① 深入理解虚拟阻抗与统一有源阻尼在并网逆变器中的物理机理与数学建模方法;② 掌握SVPWM与SPWM调制策略的原理、实现流程及其在Simulink中的建模技巧;③ 设计、实现并仿真验证能够提升并网系统稳定性的先进控制算法;④ 为解决实际工程中诸如低电压穿越、谐振抑制、弱电网适应性等关键技术难题提供可靠的理论依据技术方案。; 阅读建议:建议读者结合提供的Simulink模型文件进行动手实践,重点关注控制环路的设计思路、关键参数的整定过程以及仿真结果的细致分析,同时可进一步延伸学习阻抗建模、扫频法等系统稳定性分析手段,以全面提升在电力电子系统仿真、分析与控制设计方面的综合能力。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值