为何CloudWatch统计的计数与AWS API Gateway错误计数不一致?
问题原因说明
该计数异常是CloudWatch指标统计规则的常见误用,核心原因如下:
- 统计聚合类型选择错误
CloudWatch指标的Count统计项代表的是指定时间窗口内上报的指标样本的数量,而非对应事件的发生总次数。你要统计5XX错误的总发生次数,需要选择Sum(求和)聚合类型,此时返回的数值才会匹配你实际触发的50次错误数。你当前选择Count统计时,只要1分钟窗口内有至少1次5XX错误上报,该窗口的Count值就只会显示1,和实际错误次数无关。 - 告警与指标查询的统计配置不一致
你的告警规则本身配置的是Sum聚合统计(只要1分钟内Sum值≥1就触发告警),所以告警触发逻辑完全正常,只是你后续查看指标时默认选中了Count统计项,才会出现数值不符的情况。 - 时间粒度配置过粗
如果你查询指标时将时间聚合粒度设置为大于1分钟的区间(比如5分钟、1小时),同时搭配了Maximum(最大值)统计规则,也会出现数值被聚合为1的情况,调整时间粒度到1分钟并切换到Sum统计即可看到真实的错误计数。
内容的提问来源于stack exchange,提问作者user630702
相关产品推荐
相关产品推荐

