寻求IBM Cloud Private集群有序关闭的官方文档及操作指引
有序关闭IBM Cloud Private-CE 2.1.0.2集群的实操步骤
我刚好在类似的小集群环境里处理过ICP-CE的启停需求,给你整理了经过验证的有序关闭流程,完全适配你家庭场景下的单节点/小规模集群:
第一步:前期确认
- 先通过
icpmaster:8443/console登录集群控制台,确认所有运行中的工作负载都没有正在执行的关键任务(比如数据同步、批量计算),避免强制关闭导致数据丢失。 - 通过SSH登录到主Master节点(命令示例:
ssh root@icpmaster),确保拥有root或集群管理员权限。
第二步:关闭Worker节点(运行应用负载的节点)
Worker节点是业务负载的载体,需要先做好负载隔离再关闭:
- 先列出所有Worker节点(单节点集群也会返回一条结果):
kubectl get nodes -l node-role.kubernetes.io/worker=true - 将Worker节点标记为不可调度,防止新负载被分配过来:
kubectl cordon <worker-node-name> - 驱逐节点上的运行负载(如果是单Worker节点,这一步可以跳过,因为没有其他节点承接负载):
kubectl drain <worker-node-name> --ignore-daemonsets备注:
--ignore-daemonsets是因为守护进程类的负载会随节点关闭自动停止,无需强制驱逐。 - 确认节点上的负载都已停止后,关闭节点操作系统:
如果你是在ESXi上管理虚拟机,也可以通过vSphere客户端执行「优雅关闭虚拟机」操作。shutdown -h now
第三步:关闭Master/ETCD核心节点
Master和ETCD是集群的大脑,单节点集群直接执行以下步骤即可:
- 先确认ETCD集群状态(单节点集群可忽略这一步):
etcdctl cluster-health - 关闭主Master节点:
如果你是多Master集群,记得先关闭备用Master节点,最后再关闭主Master节点。shutdown -h now
第四步:关闭附属基础设施(可选)
如果你部署了额外的集群依赖组件(比如独立NFS存储节点、负载均衡器VM),最后再关闭这些节点即可。
附加:集群重启顺序参考
等你需要重新启动集群时,记得按反向顺序操作:先启动附属基础设施→主Master节点→备用Master节点→Worker节点,Worker节点启动后执行kubectl uncordon <worker-node-name>恢复负载调度。
内容的提问来源于stack exchange,提问作者Chris Clark
相关产品推荐
相关产品推荐

