关于Compute Engine自定义仪表盘中disk bytes used指标无法正常选择及配置的技术求助
解决GCE实例磁盘空间监控(disk bytes used指标)的问题
我之前也碰到过完全一样的情况!当时找了好久才搞明白怎么让这个指标正常活跃起来,下面是亲测有效的解决方案:
1. 检查并配置OS Agent的监控采集规则
虽然你装了最新版的OS Agent,但磁盘相关的指标默认可能没被启用。你需要手动调整配置:
- 登录到你的GCE虚拟机,打开OS Agent的配置文件:
sudo nano /etc/google-cloud-ops-agent/config.yaml - 确保文件里包含磁盘指标的采集配置,如果没有,直接添加以下内容(如果已有
metrics部分,就把对应的hostmetrics配置合并进去):metrics: receivers: hostmetrics: type: hostmetrics collection_interval: 60s metrics: filesystem: include: ["/"] # 这里可以添加你需要监控的其他挂载点,比如["/", "/data"] exclude: [] metrics: - disk.bytes.used - disk.bytes.free - disk.bytes.total service: pipelines: default_pipeline: receivers: [hostmetrics] - 保存配置后,重启OS Agent服务让配置生效:
sudo systemctl restart google-cloud-ops-agent
2. 等待指标上报并验证
重启服务后,需要等待5-10分钟左右,让指标开始被采集并同步到Cloud Monitoring。这时回到自定义仪表板界面:
- 不用再关闭「Only Show Active」选项,应该就能直接找到
disk.bytes.used指标了 - 如果还是没显示,可以暂时关闭「Only Show Active」确认指标是否存在,一般等待一会儿就会变成活跃状态
额外排查点(如果以上步骤无效)
- 权限检查:确保你的GCE实例的服务账号拥有
roles/monitoring.metricWriter角色,默认情况下实例的服务账号是具备这个权限的,如果被修改过,需要重新添加 - 日志排查:查看OS Agent的运行日志,排查是否有采集错误:
日志里如果出现磁盘挂载点不存在、权限不足之类的报错,就可以针对性解决sudo journalctl -u google-cloud-ops-agent -f
内容的提问来源于stack exchange,提问作者Terry Chambers - Onix
相关产品推荐
相关产品推荐

