Avalanche集群节点无报错自动停止问题求助
我使用avalanche-network-runner搭建Avalanche集群节点,节点可正常启动,但运行一段时间后自动停止,停止时的日志如下:
[node1] INFO [11-24|17:23:12.281] <C Chain> github.com/ava-labs/coreth/core/blockchain.go:787: State manager shut down t="51.625µs" [node1] INFO [11-24|17:23:12.281] <C Chain> github.com/ava-labs/coreth/core/blockchain.go:794: Shutting down sender cacher [node1] INFO [11-24|17:23:12.281] <C Chain> github.com/ava-labs/coreth/core/blockchain.go:798: Closing scope [node1] INFO [11-24|17:23:12.281] <C Chain> github.com/ava-labs/coreth/core/blockchain.go:802: Waiting for trie re-journal to complete [node1] INFO [11-24|17:23:12.281] <C Chain> github.com/ava-labs/coreth/core/blockchain.go:805: Blockchain stopped [11-24|17:23:12.292] INFO local/network.go:740 done stopping network terminated network %!s(<nil>) [11-24|17:23:12.292] INFO ux/output.go:14 terminated network %!s(<nil>) [11-24|17:23:12.292] INFO server/server.go:376 no custom chain installation request, skipping its readiness check
排查方向与解决方法
检查系统资源限制
节点运行时内存、CPU占用过高,可能触发系统OOM killer强制终止进程。执行dmesg | grep -i oom或查看系统日志(如/var/log/syslog),确认是否存在资源不足导致的进程终止。
解决:调整节点资源分配,若用容器部署可通过--memory、--cpu参数限制资源;或优化节点配置文件中的内存相关参数,降低资源消耗。确认network-runner运行模式
若以交互式模式启动,终端会话中断(如关闭终端、SSH断开)会直接终止network-runner进程,导致集群停止。建议以服务模式启动:avalanche-network-runner server \ --log-level info \ --port=":8080"后续通过API或CLI命令管理集群,避免会话依赖。
验证节点配置与权限
检查节点配置文件(如config.json)是否存在参数错误(如端口冲突、数据目录配置错误),可先尝试用默认配置启动集群,排除自定义配置问题。
同时确认数据目录的读写权限,确保运行network-runner的用户拥有完整的目录读写权限。获取完整debug日志
当前日志仅显示停止阶段信息,需查看运行周期内的完整日志。启动network-runner时添加--log-level debug参数,获取更详细的日志输出,重点排查停止前几分钟的警告或错误信息。检查版本兼容性
确认avalanche-network-runner与avalanchego的版本是否匹配,版本不兼容可能导致异常终止。建议使用官方文档推荐的对应版本组合。
内容的提问来源于stack exchange,提问作者heypran

