Thruk报表模块SLA计算规则咨询
Thruk 报表模块 SLA 计算逻辑
Thruk的SLA统计完全基于底层对接的监控引擎(Nagios/Naemon/Icinga等)上报的历史状态数据,统计范围为报表创建时指定的起止时间区间,核心计算逻辑如下:
- 核心计算公式:
SLA 可用率 = (统计区间总时长 - 不可用状态累计时长) / 统计区间总时长 * 100% - 主机状态可用性判定规则:
- 计入可用的状态:UP
- 计入不可用的状态:DOWN、UNREACHABLE
- 默认不计入统计的状态:监控未初始化的PENDING状态、处于预设停机维护时段内的所有异常状态、已手动确认的异常状态(可在报表配置中修改是否忽略已确认状态)
- 服务状态可用性判定规则:
- 计入可用的状态:OK、默认包含WARNING状态,若需将WARNING纳入不可用统计,可在报表SLA配置项中手动调整判定阈值
- 计入不可用的状态:CRITICAL、UNKNOWN
- 默认不计入统计的状态:同主机规则,PENDING状态、维护时段内异常、已确认异常(可配置)
- 统计精度说明:时间计算默认精确到秒,与底层监控的状态检查粒度对齐,短时间状态波动不会被自动抹除,除非你在报表配置中开启了「忽略小于X秒的状态变更」选项。
- 自定义规则说明:所有你在报表配置中修改的SLA判定规则,都会自动显示在最终生成的报表底部,可直接提供给客户做核对依据。
内容的提问来源于stack exchange,提问作者fabricedupre
相关产品推荐
相关产品推荐

