CDH 6.3.2版本YARN是否存在资源/节点限制?扩容后资源受限咨询
CDH 6.3.2 YARN资源限制与扩容后AM资源异常分析
一、CDH 6.3.2 YARN核心资源限制规则
CDH 6.3.2基于Apache Hadoop 3.0.0-cdh6.3.2,除继承原生YARN资源限制外,有以下关键默认配置与强化限制:
集群级资源上限:
- YARN资源管理器(RM)默认对单节点的最大可分配资源设硬限制:
yarn.resourcemanager.scheduler.maximum-allocation-mb默认8192MB,yarn.resourcemanager.scheduler.maximum-allocation-vcores默认8核。若新增节点资源配置超出该值,超出部分不会被纳入集群总资源池。 - 无硬性节点数量限制,但节点数超200台时RM调度性能会下降;28台节点远低于该阈值,不会触发性能类限制。
- YARN资源管理器(RM)默认对单节点的最大可分配资源设硬限制:
应用主容器(AM)资源限制:
- 全局层面:
yarn.scheduler.fair.max-am-resource-percent默认设为0.1(集群总资源的10%),限制所有队列的AM资源总和上限。 - 队列层面:公平调度队列可继承全局默认的
maxAMResourcePercent(百分比),或单独配置maxAMResources(绝对值)。若队列用百分比配置,集群总资源计算异常时,AM资源上限会同步变化。
- 全局层面:
节点级资源限制:
- NodeManager的
yarn.nodemanager.resource.memory-mb和yarn.nodemanager.resource.cpu-vcores定义单节点可贡献的最大资源,CDH默认会按节点硬件自动配置;若手动修改过配置,新增节点需保持一致,否则会导致资源池计算混乱。
- NodeManager的
二、扩容后max AM Resources变小的核心原因
结合26→28节点的场景,大概率是以下两种情况:
新增节点资源未被正确纳入集群总资源池
- 新增NodeManager未完成注册,或节点上报的资源远低于原有节点(配置错误、硬件差异),导致集群总资源不增反降;若队列AM资源上限为百分比配置,自然会随之变小。
- 可通过YARN UI的Nodes页面确认新增节点状态为
RUNNING,且上报的内存、CPU资源与原有节点一致。
公平调度队列的AM资源配置为固定绝对值
- 如果队列的
maxAMResources设置为固定数值(而非百分比),扩容后集群总资源增加,但队列AM上限未调整,会出现相对资源占比下降的情况,导致感知上“AM资源变小”。
- 如果队列的
三、验证与解决步骤
确认集群总资源准确性
- 登录YARN RM UI(默认端口8088),查看Cluster Metrics中的
Total Memory和Total Virtual Cores,确认数值为原有节点资源+新增节点资源的总和。
- 登录YARN RM UI(默认端口8088),查看Cluster Metrics中的
检查公平调度配置
- 在CDH Manager中进入YARN服务的配置→公平调度模块:
- 确认全局参数
yarn.scheduler.fair.max-am-resource-percent为预期值(比如0.1或更高)。 - 检查目标队列的
maxAMResourcePercent(百分比)或maxAMResources(绝对值)配置,若为绝对值,需根据扩容后的总资源调整数值。
- 确认全局参数
- 在CDH Manager中进入YARN服务的配置→公平调度模块:
校验新增节点配置
- 对比新增节点与原有节点的NodeManager配置,确保
yarn.nodemanager.resource.memory-mb、yarn.nodemanager.resource.cpu-vcores与集群统一配置一致。 - 检查节点排除列表:查看
yarn.resourcemanager.nodes.exclude-path配置,确保新增节点不在排除文件中。
- 对比新增节点与原有节点的NodeManager配置,确保
内容的提问来源于stack exchange,提问作者user23585338
相关产品推荐
相关产品推荐

