Ubuntu Server执行rclone同步操作时崩溃无响应的问题排查求助
Ubuntu Server执行rclone同步操作时崩溃无响应的问题排查求助
大家好,我遇到了一个挺棘手的问题,想请各位大佬帮忙排查下:
我正在用rclone同步并校验多组源目录和目标目录,但每次运行这个操作的时候,我的Ubuntu Server虚拟机都会直接冻住。
崩溃后的具体表现是:虚拟机完全无响应,客户机代理停止运行,连SSH都连不进去,也没法正常关机——只能给VM发送STOP指令,或者干脆重启整个ProxMox PVE节点,才能让VM停下来。
目前我排查了内存使用情况,看起来不是内存不足的问题,Ubuntu Server的各项监控指标都显示正常。我感觉不是rclone本身导致系统冻结,更像是高速读写大量数据时的I/O相关问题。
我自己查了不少调试Ubuntu Server的资料,目前做了这些尝试,整理出以下信息:
已收集的调试信息
我执行了内核日志错误筛选命令:
sudo cat /var/log/kern.log | grep error
得到的错误日志内容如下:
日志中包含多条块设备I/O错误、SCSI设备通信失败相关的内核报错,例如:
blk_update_request: I/O error, dev sda, sector 123456 op 0x0:(READ) flags 0x80700 phys_seg 1 prio class 0sd 0:0:0:0: [sda] tag#19 FAILED Result: hostbyte=DID_ERROR driverbyte=DRIVER_OK
目前我还在尝试其他调试操作,但还没拿到更多有效信息,希望各位能给我一些下一步排查的方向,比如如何更精准地定位这类I/O相关的系统崩溃问题?
备注:内容来源于stack exchange,提问作者atkuzmanov
相关产品推荐
相关产品推荐

