GridDB多播模式启动失败,请求配置排查帮助
GridDB多播模式配置错误排查与修正
你的配置存在三个关键问题,直接导致启动失败:
1. 未明确指定多播集群模式
GridDB不会自动切换到多播模式,必须在cluster节点下添加"clusterMode": "MULTICAST"字段,否则会默认沿用FIXED模式逻辑,导致节点匹配失败。
2. 多播地址使用错误
127.0.0.1是回环地址,不支持多播通信,必须使用标准多播IP段(范围224.0.0.0~239.255.255.255),比如常用的239.0.0.1。
3. 缺失节点自身端口监听配置
你删除了FIXED模式下的notificationMember,但多播模式仍需指定当前节点的各类服务端口(cluster、sync、system等),否则GridDB不知道要监听哪些端口,才会出现报错里的127.0.0.1:10040连接被拒绝问题。
修正后的完整配置示例
{ "dataStore": { "partitionNum": 128, "storeBlockSize": "64KB" }, "cluster": { "clusterName": "myCluster", "clusterMode": "MULTICAST", "replicationNum": 2, "notificationInterval": "5s", "notificationAddress": "239.0.0.1", "notificationPort": 31999, "heartbeatInterval": "5s", "loadbalanceCheckInterval": "180s", "cluster": {"address": "127.0.0.1", "port": 10010}, "sync": {"address": "127.0.0.1", "port": 10020}, "system": {"address": "127.0.0.1", "port": 10040}, "transaction": {"address": "127.0.0.1", "port": 10001}, "sql": {"address": "127.0.0.1", "port": 20001} }, "sync": { "timeoutInterval": "30s" }, "transaction": { "replicationMode": 0, "replicationTimeoutInterval": "10s" }, "sql": {} }
额外启动注意事项
- WSL环境需开启多播支持:在WSL内执行
sudo sysctl -w net.ipv4.ip_forward=1和sudo sysctl -w net.ipv4.icmp_echo_ignore_broadcasts=0开启相关配置。 - 清理旧集群数据(可选):如果之前FIXED模式的残留数据导致冲突,可停止服务后删除
/var/lib/gridstore/data目录下的文件(注意备份数据)。 - 端口冲突检查:确保配置中的所有端口(10010、10020、10040等)未被其他进程占用。
内容的提问来源于stack exchange,提问作者Omi A
相关产品推荐
相关产品推荐

