RHEL DHCP配置10.128.0.0/14后部分CoreOS节点获取172.x段IP问题咨询
CoreOS节点异常获取172段IP故障排查解决流程
一、RHEL侧DHCP服务端排查
- 确认DHCP服务运行状态:执行
systemctl status dhcpd查看服务是否正常运行,若存在报错先执行systemctl restart dhcpd重启服务,再次验证状态。 - 校验DHCP配置合法性:
- 打开默认配置文件
/etc/dhcp/dhcpd.conf,确认全局地址池配置为10.128.0.0/14,无未注释的172段地址池配置 - 核对故障CoreOS节点的MAC绑定规则,确认MAC地址和VMware控制台显示的节点网卡MAC完全一致,绑定的固定IP属于10段,无拼写错误
- 执行
dhcpd -t校验配置语法,无报错后执行systemctl reload dhcpd重载配置
- 打开默认配置文件
- 清理异常租期记录:查看租期文件
/var/lib/dhcpd/dhcpd.leases,搜索故障节点MAC对应的172段IP租期条目,手动删除后重启DHCP服务。 - 校验防火墙规则:执行
firewall-cmd --list-all(firewalld服务)或iptables -L -n,确认UDP 67/68端口已放行,无拦截DHCP请求的规则。 - 高优先级排查:检测私设DHCP服务:这是当前场景下最高概率的根因,在RHEL服务器上执行
tcpdump -i 业务网卡名 udp port 67 or port 68 -nn,同时在故障CoreOS节点触发DHCP续约,抓包确认是否存在除当前RHEL DHCP服务器IP之外的其他源IP回复DHCP Offer。如果有其他IP回复,即可定位为环境中存在rogue DHCP服务,找到对应设备关闭即可。
二、CoreOS客户端侧排查
- 核对网卡MAC地址:在CoreOS节点执行
ip link show,对比VMware控制台配置、DHCP绑定规则中的MAC是否一致。硬件故障+存储异常可能导致虚拟机配置漂移,出现MAC变更,如果不一致直接更新DHCP绑定配置即可。 - 检查本地网络配置:CoreOS默认使用systemd-networkd或NetworkManager管理网络,查看
/etc/systemd/network/*.network或/etc/NetworkManager/system-connections/下的配置文件,确认无手动配置的静态172段IP,也未指定其他DHCP服务器地址。 - 手动触发DHCP续约排查:执行
dhclient -v 网卡名触发重新获取IP,查看返回的DHCP Offer源IP,确认是否为你的RHEL DHCP服务器地址。 - 清理本地租期缓存:删除
/var/lib/dhclient/*.leases文件,执行systemctl restart systemd-networkd(或NetworkManager服务)重启网络,重新申请IP。
三、修复验证
- 故障节点执行
ip a确认已获取到绑定的10段IP - 检查RHEL DHCP服务器的租期文件,确认对应MAC的租期IP为绑定的10段地址
- 测试节点跨网段通信、集群内部通信正常
内容的提问来源于stack exchange,提问作者spm
相关产品推荐
相关产品推荐

