GridDB集群未自动切换至新主节点问题求助
GridDB集群主节点未自动切换排查方案
关键排查与修复步骤
- 检查集群管理模式配置:确认
cluster.json中的clusterManagerMode是否为AUTO,手动模式下不会触发自动切换。查看命令:
若为cat /var/lib/griddb/conf/cluster.json | grep clusterManagerModeMANUAL,修改后重启所有节点生效。 - 验证节点心跳连通性:所有节点必须通过默认心跳端口10001互通,用nc测试:
若存在不通情况,排查防火墙规则、网络路由残留问题——即使网络恢复,部分节点可能存在会话阻塞。nc -zv <目标节点IP> 10001 - 查看主节点状态:登录任意节点执行
gs_stat,确认主节点状态是否异常。若主节点标记为非活跃但未触发选举,可能是元数据不一致。 - 手动触发选举:确认所有节点在线后,执行命令触发主节点选举:
gs_cluster election -n <任意从节点IP> - 修复元数据一致性:执行
gs_cluster check检测元数据冲突,存在问题时用gs_cluster repair修复。
预防措施
- 固定
clusterManagerMode为AUTO,避免手动模式导致自动切换失效。 - 配置监控告警,实时监控心跳端口连通性及主节点状态。
- 定期执行
gs_cluster check,提前发现潜在元数据问题。
内容的提问来源于stack exchange,提问作者tee
相关产品推荐
相关产品推荐

