如何为AKS节点升级增加Node Drain Timeout(节点驱逐超时)时长
解决AKS节点升级时长优雅停机Pod导致的驱逐超时问题
针对你遇到的AKS节点升级因长优雅停机Pod触发驱逐超时失败的问题,可通过以下方式调整节点驱逐超时时间:
核心解决方案:调整AKS节点池的驱逐超时配置
这个超时是AKS特有的配置,用于控制集群自动执行节点升级时的drain操作超时,可通过Azure CLI修改节点池参数:
更新现有节点池的驱逐超时
执行以下命令,将目标节点池的驱逐超时设置为31小时:
az aks nodepool update --resource-group <你的资源组名称> --cluster-name <你的AKS集群名称> --name <目标节点池名称> --node-drain-timeout 31h
若创建新节点池,可直接指定超时参数
如果是新建节点池,在创建时加入超时配置:
az aks nodepool add --resource-group <你的资源组名称> --cluster-name <你的AKS集群名称> --name <新节点池名称> --node-count <节点数量> --node-drain-timeout 31h
关键说明
- 该参数仅对AKS控制平面自动触发的节点drain操作生效(比如节点升级、节点缩放移除等场景),完全覆盖默认的1小时超时,适配你的长优雅停机Pod需求。
- 结合你的PDB
maxUnavailable=1设置,31小时的超时足够覆盖单个节点上2个15小时优雅停机Pod的逐次驱逐流程(含缓冲时间)。 - 确保你的Azure CLI版本为最新,避免参数不兼容问题,可执行
az upgrade完成CLI更新。
内容的提问来源于stack exchange,提问作者InDieTasten
相关产品推荐
相关产品推荐

