Kind多集群创建时kubeadm节点加入失败的排查与解决方法求助
大家好,我最近在部署K8ssandra相关环境时遇到了Kind集群创建的问题,想请社区的大佬们帮忙分析下。
先跟大家说下目前的环境情况:
- 单独创建单节点Kind集群是完全正常的,执行
kind create cluster能顺利完成所有步骤,之后用kubectl cluster-info --context kind-kind能正常获取控制平面和CoreDNS的地址,kind get clusters也能看到创建好的集群。
但当我运行K8ssandra Operator提供的脚本创建带多worker节点的集群时,就出问题了:
我执行的命令是:
scripts/setup-kind-multicluster.sh --clusters 1 --kind-worker-nodes 5
脚本在执行到Joining worker nodes这一步时失败了,报错内容如下:
✓ Installing StorageClass
✗ Joining worker nodes
Deleted nodes: ["k8ssandra-0-worker" "k8ssandra-0-worker3" "k8ssandra-0-worker5" "k8ssandra-0-control-plane" "k8ssandra-0-worker2" "k8ssandra-0-worker4"]
ERROR: failed to create cluster: failed to join node with kubeadm: command "docker exec --privileged k8ssandra-0-worker5 kubeadm join --config /kind/kubeadm.conf --skip-phases=preflight --v=6" failed with error: exit status 1
另外我还有两个关键信息可以提供:
- 这次执行的完整日志
- 集群的cluster-info dump内容
想请教下大家,我应该从哪些方面入手排查这个问题的根因?又该怎么解决这个节点加入失败的问题呢?
备注:内容来源于stack exchange,提问作者Raphael10

