You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在CloudWatch中监控Fargate ECS Web应用及ALB超时?

如何监控ALB请求超时并触发告警

你提到的TargetResponseTime确实不会统计超时请求——这个指标只记录成功从目标服务收到响应的请求耗时,超时请求根本不会生成这个指标。要监控ALB层面的超时,得用以下几个CloudWatch指标组合:

核心超时相关指标

  • HTTPCode_Target_5xx:当ALB等待Fargate任务响应超时(默认60秒,可在目标组属性里调整),会给客户端返回504 Gateway Timeout,这个指标会统计这类5xx状态码的请求数,是监控超时最直接的指标。
  • TargetConnectionError:统计ALB无法连接到目标任务的次数,其中包含连接超时的场景,适合排查初始化连接阶段的超时问题。
  • RequestCount(辅助):可以和上面的指标结合,计算超时请求的占比,更精准判断异常程度。

配置告警的具体步骤

  1. 打开CloudWatch控制台,进入「告警」页面点击「创建告警」
  2. 选择指标命名空间AWS/ApplicationELB,找到你的ALB对应的目标指标:
    • 比如选HTTPCode_Target_5xx,统计周期选1分钟,统计方式选Sum
    • 或者选TargetConnectionError,同样用Sum统计
  3. 设置告警阈值:比如1分钟内HTTPCode_Target_5xx总和超过5次时触发告警
  4. 配置通知方式:关联SNS主题,绑定邮箱、短信或者其他通知渠道
  5. 完成告警创建

额外排查建议

如果超时告警触发,还可以结合这些指标定位根因:

  • TargetResponseTime:查看正常请求的响应耗时,判断是不是服务本身处理变慢导致超时
  • HealthyHostCount:检查目标组里的Fargate任务健康状态,有没有任务异常退出
  • ECS命名空间下的CPUUtilization、MemoryUtilization:排查Fargate任务是不是资源过载

注意点

  • ALB的目标响应超时时间可以在目标组「属性」里修改(范围1-3600秒),调整后超时触发逻辑也会跟着变
  • 如果是Fargate任务内部的处理超时(比如代码逻辑卡住),ALB也会返回504,这时候需要结合服务自身的日志排查

内容的提问来源于stack exchange,提问作者Andrew

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.20 06:54:22