私有服务器运行12小时后无法访问的问题排查求助(NAT组网场景)
私有服务器运行12小时后无法访问的问题排查求助(NAT组网场景)
各位大佬好,我最近碰到个棘手的网络问题:我有两台服务器,一台是公网节点(pub),一台是私有节点(priv),它们通过NAT网关进行通信。但私有服务器运行大概12小时后就突然变得完全无法访问了。我对Linux网络这块不太精通,真心希望有人能帮我分析下到底发生了什么,以及该怎么排查解决,感激不尽!
私有服务器(客户端)的配置脚本:
runcmd: - | cat <<EOF >> "/etc/systemd/resolved.conf" [Resolve] DNS=185.12.64.2 185.12.64.1 EOF - | cat <<'EOF' >> /etc/network/interfaces auto enp7s0 iface enp7s0 inet dhcp post-up ip route add default via ${ip_gateway} dns-nameservers 185.12.64.2 185.12.64.1 EOF
NAT网关服务器的配置脚本:
runcmd: - | cat <<EOF >> "/etc/network/interfaces" auto eth0 iface eth0 inet dhcp post-up echo 1 > /proc/sys/net/ipv4/ip_forward post-up iptables -t nat -A POSTROUTING -s '${ip_range}' -o eth0 -j MASQUERADE EOF - sudo sed -i -e '/^\(#\|\)IP...' # 注:此处配置内容存在输入截断
我自己琢磨的几个可能方向,但不确定对不对:
- DHCP租约到期:私有服务器用DHCP获取IP,会不会12小时刚好是DHCP租约时长?租约到期后没自动续约,导致IP变更或者路由规则失效?
- NAT会话超时:NAT网关的连接跟踪有没有超时设置?如果私有服务器长时间没对外发流量,NAT的会话条目被清理,是不是就没法建立新连接了?
- 系统服务异常:比如networking或者systemd-resolved这类网络相关服务,运行12小时后崩溃了?
- 防火墙规则丢失:有没有可能iptables的NAT规则在某些情况下被重置了?
有没有大佬能给我指条明路,告诉我该怎么一步步排查这些可能性,或者还有其他我没考虑到的原因吗?
备注:内容来源于stack exchange,提问作者Guilherme Caixeta
相关产品推荐
相关产品推荐

