OpenShift共享集群微服务Pod调度失败问题排查求助
问题分析:OpenShift共享集群Pod调度失败及权限限制问题
错误现象
Pod调度失败,报错信息如下:
0/28 nodes are available: 25 node(s) didn't find available persistent volumes to bind, 3 node(s) had taint, that the pod didn't tolerate
相关配置(values.yaml)
workerNodeSelector: - key: is_worker value: 'true' edgeNodeSelector: - key: is_worker value: 'true' workerTolerations: - key: is_worker operator: Equal effect: NoSchedule value: 'true' edgeTolerations: - key: is_worker operator: Equal effect: NoExecute value: 'true'
(注:原配置格式已调整为标准YAML格式以提升可读性)
权限限制
无法执行以下排查命令:
oc get pvoc get pvc -n <namespace>oc get nodes
原因分析
- 持久化存储匹配失败:25个节点无法绑定可用PV,说明应用声明的PVC与集群内现有PV不匹配。可能原因包括:集群存储资源耗尽、PVC指定的存储类不存在、PVC的容量/访问模式不符合集群存储规则。由于无权限查看存储资源详情,需联系集群管理员确认存储状态。
- 节点污点容忍不匹配:3个节点的污点未被Pod兼容。从values.yaml配置看,worker节点配置的是
NoSchedule类型的is_worker=true污点容忍,edge节点是NoExecute类型的同key容忍,但这3个节点的污点可能并非此配置(比如污点key/effect不同),或者应用部署模板未正确引用这些容忍规则,导致Pod无法调度到这些节点。 - 集群权限管控:无法查询节点、存储资源,是共享集群的权限策略限制了账号权限,需联系集群管理员申请对应资源的查看权限,才能进一步定位问题细节。
内容的提问来源于stack exchange,提问作者Pooja CL
相关产品推荐
相关产品推荐

