关于Prometheus中topk聚合算子查询结果异常的技术问询
为什么Prometheus的topk查询返回了大量结果?
你的问题出在对topk结合without的逻辑理解上:
- 你执行的
topk without(job)(2, node_cpu_seconds_total),并不是从所有序列里取全局Top2,而是以cpu、instance、mode这三个标签作为分组依据(without(job)表示排除job标签,剩下的标签自动成为分组键),然后每个分组内独立筛选Top2的序列。 - 从你给出的结果能看到,每个序列的
cpu+instance+mode组合都是唯一的,每个分组里只有1个时间序列。这种情况下,top2自然会保留这个唯一的序列,最终所有序列都被返回,导致结果数量远超预期。
修正方案
- 若要从所有
node_cpu_seconds_total序列中取数值最大的全局Top2,直接去掉without(job)即可:topk(2, node_cpu_seconds_total) - 若要按特定维度分组取Top2(比如每个实例下取Top2的CPU模式),用
by()明确指定分组键,例如按实例分组:topk by(instance)(2, node_cpu_seconds_total)
内容的提问来源于stack exchange,提问作者Emad Khavaninzadeh
相关产品推荐
相关产品推荐

