如何让GCP在VM停机/停止时实时发送告警而非重启后触发?
GCP VM停机/停止时实时告警配置方案
一、使用实例状态指标创建精准告警(推荐)
这是最直接的实时告警方式,无需依赖CPU指标:
- 登录GCP控制台,进入Cloud Monitoring → 告警 → 创建政策
- 在「选择指标」环节,搜索
Compute Engine>VM Instance>Instance state指标 - 配置触发条件:当
Instance state等于TERMINATED(停止)或STOPPED(停机)时触发告警 - 设置通知渠道:确保已配置邮件、短信或企业IM(如Slack)等通知方式,触发时机选择「立即通知」
- 调整高级参数:将「延迟触发时长」设为1分钟以内(GCP指标采集默认间隔1分钟),避免延迟
二、优化原有缺失CPU指标的告警配置
若要保留原方案,需调整以下关键配置:
- 进入已创建的告警政策,编辑条件规则
- 将「缺失数据触发逻辑」从「重启后回溯」改为「连续缺失1-2分钟后立即触发」
- 在通知设置中,勾选「当条件变为真时立即发送通知」,取消「仅当状态从假变真时发送」的限制
- 确认告警的目标资源为指定VM实例,未选错资源范围
三、必要的前置检查
- 确保目标VM已启用Cloud Monitoring监控代理(自定义镜像需手动安装)
- 配置告警的账号需拥有
roles/monitoring.editor或更高权限 - 手动停止VM进行测试,验证通知是否在1-2分钟内送达
内容的提问来源于stack exchange,提问作者Edward Lafferty
相关产品推荐
相关产品推荐

