如何在Datadog中监控AWS QLDB并集成Pagerduty
监控AWS QLDB并集成Datadog与Pagerduty的方案
QLDB本身没有直接的Datadog官方集成,得通过AWS CloudWatch中转实现监控,下面是具体操作步骤:
1. 确认QLDB指标已推送至CloudWatch
AWS QLDB默认会把核心指标发送到CloudWatch,对应的命名空间是AWS/QLDB,包含的关键指标有:
ReadIOs:读取IO操作数WriteIOs:写入IO操作数TransactionCommitted:成功提交的事务数TransactionAborted:中止的事务数SessionCount:活跃会话数
你可以登录CloudWatch控制台,在「指标」页面搜索AWS/QLDB,确认这些指标是否正常生成。
2. 配置Datadog拉取CloudWatch中的QLDB指标
先确保你已经在Datadog完成了AWS集成(如果没做,去「集成」→「AWS」页面配置IAM角色,授予Datadog读取CloudWatch指标的权限),之后:
- 进入Datadog的「AWS集成」配置页,找到「指标收集」板块
- 在「命名空间」列表里勾选
AWS/QLDB,保存配置 - 等待3-5分钟,Datadog就会开始同步QLDB的CloudWatch指标
3. 创建QLDB监控告警
在Datadog的「监控」→「新建监控」→「指标告警」中,设置针对QLDB的告警规则:
- 选择数据源为
AWS/QLDB下的对应指标,比如监控TransactionAborted的增长率 - 设置阈值,比如5分钟内事务中止率超过10%时触发告警
- 配置告警消息,带上QLDB集群名称、指标数值等关键信息
4. 集成Pagerduty接收告警
- 进入Datadog的「集成」→「Pagerduty」页面,按照引导完成账号关联,创建专属的通知服务
- 回到之前创建的QLDB告警规则,在「通知」板块添加刚配置的Pagerduty服务
- 手动触发一次告警测试,确认Pagerduty能正常收到Datadog推送的QLDB告警事件
补充:自定义QLDB指标(默认指标不够用的情况)
如果需要监控QLDB日志里的自定义内容(比如特定事务类型的执行耗时),可以这么做:
- 开启QLDB的日志导出功能,把日志发送到CloudWatch Logs
- 用CloudWatch Logs Insights编写查询,提取需要的自定义数据
- 通过Lambda函数把查询结果转换成自定义指标,发送到CloudWatch或直接推送到Datadog
- 在Datadog中添加这些自定义指标的监控规则
内容的提问来源于stack exchange,提问作者Majd Rezik
相关产品推荐
相关产品推荐

