bitnami/kube-prometheus部署集群Prometheus graph页无自定义指标如何解决
Kubernetes bitnami/kube-prometheus 自定义指标无法查询排查方案
1. 确认采集目标状态
- 访问Prometheus UI的
Status > Targets页,核对自定义指标对应的采集目标状态为UP,最近一次采集时间在1分钟以内,无采集错误提示 - 若存在采集错误,优先排查指标暴露路径是否正确、服务网络是否放通、Prometheus RBAC权限是否覆盖业务服务所在命名空间
2. 核对采集规则配置
- 检查你创建的
ServiceMonitor或PodMonitor资源配置:namespaceSelector是否匹配业务服务所在的命名空间selector.matchLabels是否和业务Service/Pod的标签完全一致endpoints下的port、path参数是否和业务服务暴露指标的端口、路径匹配
- 执行命令
kubectl get servicemonitor -n <你的Prometheus部署命名空间>,确认采集规则资源已正常创建
3. 手动验证业务指标暴露
- 任选一个业务Pod,执行端口转发命令:
kubectl port-forward pod/<业务Pod名称> <本地端口>:<业务指标暴露端口> -n <业务命名空间> - 本地访问
http://localhost:<本地端口>/<指标路径>,确认返回内容中存在你期望的自定义指标,确认指标本身没有被业务代码过滤
4. 检查Prometheus存储与日志
- 配置修改完成后等待2~3个采集周期(默认采集间隔为15秒,最长等待1分钟),再刷新Graph页面尝试查询
- 查看Prometheus Pod运行日志:
kubectl logs -n <Prometheus部署命名空间> <Prometheus Pod名称> prometheus,确认没有指标丢弃、样本写入异常、存储写入失败等报错 - 核对Prometheus启动参数
--storage.tsdb.retention.time,确认数据保留时长配置合理,无刚采集就被过期清理的情况
5. 验证查询操作正确性
- 在Graph页查询框手动输入自定义指标完整名称执行查询,不要依赖自动补全列表,确认是否返回数据
- 若手动查询有数据但自动补全无内容,等待自动补全缓存刷新即可,不影响指标正常使用
内容的提问来源于stack exchange,提问作者stackuser
相关产品推荐
相关产品推荐

