You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

MariaDB Galera新节点重启时重复下载日志问题修复咨询

Galera节点重启后重复执行全量SST(删除本地数据重新下载)的解决方法

以下是针对该问题的排查与修复步骤:

  1. 修正wsrep_cluster_address配置
    你的配置中wsrep_cluster_address包含了当前节点自身的IP(192.168.0.2),这会导致节点重启时无法正确识别集群内的在线节点,触发全量SST。修改为仅指向集群中已稳定运行的节点:

    wsrep_cluster_address="gcomm://192.168.0.1"
    

    注意:仅在初始化全新集群时使用空的gcomm://,加入现有集群必须指定至少一个已在线的集群节点地址。

  2. 检查数据目录的权限与状态文件

    • 确保MySQL运行用户(通常为mysql)对数据目录拥有完整读写权限:
      chown -R mysql:mysql /var/lib/mysql
      chmod -R 750 /var/lib/mysql
      
    • 确认数据目录下存在grastate.dat文件,该文件记录节点的集群状态。如果文件丢失或损坏,节点会判定为未加入集群,触发全量SST。若文件存在,可检查其中的safe_to_bootstrap值,正常运行的节点该值应为0。
  3. 验证节点IP配置一致性
    确认wsrep_node_address设置的192.168.0.2是节点实际绑定的IP,避免因IP不匹配导致集群无法识别该节点已存在,从而重复拉取数据。

  4. 排除强制初始化集群的启动参数
    检查MySQL启动脚本或命令行参数,确保没有添加--wsrep-new-cluster参数。该参数会强制节点忽略本地数据,重新发起集群初始化流程,触发全量SST。

  5. 优化增量同步配置(可选)
    当前gcache.size=512M如果过小,节点重启时可能无法通过IST(增量状态转移)恢复,只能触发全量SST。可根据业务数据增量适当调大:

    wsrep_provider_options='gcache.size=1G'
    

    调整后需确保磁盘空间充足,避免gcache占用过多存储资源。

内容的提问来源于stack exchange,提问作者eos

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.13 03:15:48