如何使用Prometheus按Node与POD提取CPU使用率?
正确的Prometheus查询:按Node和Pod拆分CPU使用率
要获取指定节点上每个Pod的CPU使用率(占节点总CPU的百分比),你需要保留pod和节点标签的维度,同时正确关联节点总CPU核数,以下是正确的查询语句:
sum by (pod, kubernetes_io_hostname) (rate(container_cpu_usage_seconds_total{kubernetes_io_hostname="$host", container!="", namespace=~"default"}[1m])) / on(kubernetes_io_hostname) group_left sum by (kubernetes_io_hostname) (machine_cpu_cores{kubernetes_io_hostname="$host"}) * 100
为什么之前的查询失效?
- 第一个查询直接用
sum()无分组聚合,把所有Pod的CPU使用量累加,自然只能得到节点总使用率。 - 第二个查询的问题有两点:
machine_cpu_cores是节点级指标,没有pod标签,用on(pod)关联完全匹配不到数据;- 外层额外嵌套的
sum()又把pod维度的聚合结果再次合并,导致无法看到单个Pod的数据。
补充说明
如果你的需求是查看Pod自身CPU使用率(相对于Pod的CPU限制),可以用以下查询:
sum by (pod, kubernetes_io_hostname) (rate(container_cpu_usage_seconds_total{kubernetes_io_hostname="$host", container!="", namespace=~"default"}[1m])) / on(pod, kubernetes_io_hostname) group_left sum by (pod, kubernetes_io_hostname) (kube_pod_container_resource_limits_cpu_cores{kubernetes_io_hostname="$host", namespace=~"default"}) * 100
内容的提问来源于stack exchange,提问作者Python_Rookie
相关产品推荐
相关产品推荐

