Ubuntu 23.10虚拟机中NetworkManager崩溃导致网络连接丢失,求助需收集的排查日志
Ubuntu 23.10虚拟机中NetworkManager崩溃导致网络连接丢失,求助需收集的排查日志
你遇到的这个NetworkManager崩溃、网络丢连接的问题在Proxmox虚拟机环境里确实挺闹心的,好在你有干净的模板可以重置,刚好能针对性收集以下关键日志来定位问题:
一、NetworkManager核心日志
这是排查崩溃问题的核心,能直接看到它崩溃前后的运行状态、错误信息:
- 实时查看或导出NetworkManager的系统日志:
# 查看最近10分钟的日志(可根据问题出现时长调整时间范围) journalctl -u NetworkManager.service --since "10 minutes ago" # 导出到文件方便后续分析 journalctl -u NetworkManager.service > nm_crash_logs.txt - 如果NetworkManager崩溃后自动重启了,也可以加上
--follow参数实时跟踪日志,重现问题时能捕获到崩溃瞬间的细节。
二、内核网络驱动日志
排查是否是virtio网卡驱动、物理网卡(Realtek/Intel)在虚拟化层面的兼容性问题:
# 过滤内核中与网络、virtio、网卡驱动相关的日志 dmesg | grep -E 'net|eth|virtio|r8169|ixgbe'
(注:r8169是常见Realtek网卡驱动,ixgbe对应Intel i930系列网卡,可根据你的实际网卡调整关键词)
三、崩溃转储文件(捕获崩溃瞬间的进程状态)
开启系统的核心转储功能,能拿到NetworkManager崩溃时的内存快照,对定位代码级问题非常有用:
- 先确认
systemd-coredump是否启用:systemctl status systemd-coredump - 若未启用,先开启:
systemctl enable --now systemd-coredump - 重现问题后,查看并导出崩溃信息:
# 列出NetworkManager的崩溃记录 coredumpctl list NetworkManager # 获取详细的崩溃转储信息 coredumpctl info NetworkManager > nm_coredump_info.txt
四、网络状态快照(问题前后对比)
对比问题出现前后的网络配置、链路状态,确认是配置丢失还是物理链路异常:
- 问题出现前(正常状态):
ip addr show > network_normal.txt ip link show > link_normal.txt nmcli dev status > nmcli_normal.txt - 问题出现后(故障状态):
ip addr show > network_fault.txt ip link show > link_fault.txt nmcli dev status > nmcli_fault.txt
同时可以查看NetworkManager的配置文件是否被异常修改:
cat /etc/NetworkManager/NetworkManager.conf ls -l /etc/NetworkManager/system-connections/
五、Proxmox主机端日志
因为是虚拟机,主机层面的虚拟化日志也不能忽略,排查是否是虚拟机设备被主机端异常重置:
- 在Proxmox主机上查看系统日志:
journalctl -u pve-manager.service --since "10 minutes ago" cat /var/log/syslog | grep -E 'qemu|virtio|VMID' # 替换VMID为你的虚拟机ID - 也可以通过Proxmox控制台进入虚拟机的监控界面,查看设备状态:
qm monitor <你的VMID> # 输入info network查看网卡状态
建议你先重置模板虚拟机,然后按上述步骤准备好日志收集的命令,重现问题后立刻导出所有日志,这样信息的时效性和准确性最高,能更快定位到底是NetworkManager的bug、驱动兼容性问题,还是Proxmox虚拟化层面的配置疏漏。
备注:内容来源于stack exchange,提问作者Troy Osborne
相关产品推荐
相关产品推荐

