MLRun REST API吞吐量查看问题咨询(MLRun 1.3.0、Iguazio 3.5.2)
查看MLRun实时函数(nuclio)的请求/响应时长与吞吐量
方法1:Grafana中的Nuclio专属面板
在Iguazio的Grafana实例中,直接定位Nuclio内置指标面板:
- 登录Grafana后,点击左侧菜单栏「Dashboards」→「Browse」
- 搜索框输入
nuclio,找到「Nuclio Functions」或「Nuclio Function Metrics」类面板 - 进入面板后选择目标函数
nuclio-risk-sentiment,即可查看核心指标:nuclio_invocation_duration_seconds:请求处理总时长(含排队+执行),支持查看P95/P99分位数、平均值nuclio_invocation_count_total:累计请求数,结合时间范围可直接计算吞吐量(请求数/时间跨度)nuclio_queue_duration_seconds:请求排队等待时长,用于区分是排队延迟还是执行延迟
方法2:MLRun CLI拉取函数指标
如果Grafana面板未找到,可通过MLRun命令行直接获取:
- 先确认函数状态:
mlrun function get nuclio-risk-sentiment - 拉取实时指标:
mlrun function metrics nuclio-risk-sentiment
返回结果中,invocation_duration对应请求响应时长,invocation_count可用于计算吞吐量
方法3:直接访问Nuclio函数的指标端点
运行中的Nuclio函数默认暴露Prometheus指标端点:
- 通过
kubectl get pods -n <your-namespace>获取函数Pod IP(Iguazio默认命名空间为default) - 访问
http://<pod-ip>:8080/metrics,在返回内容中搜索:nuclio_invocation_duration_seconds_bucket:时长直方图数据,用于计算分位数nuclio_invocation_count_total:累计请求数,除以时间跨度得到吞吐量
注意事项
- MLRun部署实时函数时默认开启指标采集,无需额外配置
- 多租户环境下需确认拥有对应函数的指标访问权限
内容的提问来源于stack exchange,提问作者JzD
相关产品推荐
相关产品推荐

