Avalanche节点健康正常但正常运行时间持续下降问题排查
Avalanche节点Uptime异常排查与优化方案
问题详情
- 节点健康状态始终返回
true,但本地API查询到的uptime从86%持续降至76% - AvaScan显示节点uptime约为99%,服务器无停机或硬件故障记录
节点与服务器配置
Avalanche节点启动参数
--public-ip --http-port=9650 --http-host=0.0.0.0 --staking-port=9651 --chain-config-dir=/home/ubuntu/configs/chains
服务器配置
- 16 GB RAM
- 8 vCPU
- 2 TB磁盘
- Ubuntu 20.04
补充信息
- 节点健康状态持续为
true - 对等节点(peers)的uptime波动极大,范围在0-10%到40-100%之间
- 服务器无显著停机或故障
- 相关截图:
- Peers Response
- Uptime
问题原因分析
统计逻辑差异
AvaScan的uptime基于节点在区块链网络中的共识参与度(出块、签名活跃度),而本地API的uptime统计依赖节点与对等节点的连接稳定性。若节点能稳定参与共识,但与部分对等节点连接频繁中断,就会出现两边数值不一致的情况。低质量对等节点影响
对等节点uptime波动大,说明连接了大量不稳定节点。本地API的uptime计算会受这些节点牵连——频繁和低uptime节点断开重连时,会被误统计为自身“不可用”,拉低整体数值。网络连接异常
服务器网络可能存在间歇性丢包、延迟波动,或防火墙/安全组规则导致部分对等节点连接超时。虽服务器无停机,但网络层面的异常会干扰节点与对等节点的通信,影响uptime统计。节点配置缺失
启动参数仅指定--public-ip未填具体IP,可能导致节点在网络中识别异常,部分对等节点无法稳定连接,反向拉低uptime。
优化方案
修正启动参数
明确指定--public-ip为服务器公网IP,示例:--public-ip=xxx.xxx.xxx.xxx --http-port=9650 --http-host=0.0.0.0 --staking-port=9651 --chain-config-dir=/home/ubuntu/configs/chains重启节点确保网络识别正常。
过滤低质量对等节点
- 编辑链配置文件(
/home/ubuntu/configs/chains下对应文件),添加对等节点白名单,仅连接官方推荐或已知稳定的节点 - 执行以下命令查询当前对等节点,手动剔除uptime持续低于50%的节点:
curl -X POST --data '{ "jsonrpc":"2.0", "id":1, "method":"info.peers", "params":{} }' http://localhost:9650/ext/info
- 编辑链配置文件(
优化网络配置
- 检查防火墙/安全组,确保9650(HTTP)、9651(staking)端口的入站/出站规则完全开放
- 联系服务商排查网络丢包、延迟问题,必要时更换稳定线路
- 添加
--peer-list-url参数,使用官方维护的优质节点列表:--peer-list-url=https://api.avax.network/ext/info/v1/peers
监控节点状态
- 定期查询对等节点连接状态,设置告警:当对等节点平均uptime低于60%时触发提醒
- 用Prometheus+Grafana监控节点网络指标(丢包率、连接数、延迟),及时发现异常
验证共识参与状态
- 查看节点日志(
~/.avalanchego/logs)中的连接断开记录,确认是否与uptime下降时段匹配 - 使用
avalanche-cli工具检查节点共识参与情况,确保节点稳定出块、签名
- 查看节点日志(
内容的提问来源于stack exchange,提问作者Himanshu Pahuja
相关产品推荐
相关产品推荐

