You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

MLRun REST API吞吐量查看问题咨询(MLRun 1.3.0、Iguazio 3.5.2)

查看MLRun实时函数(nuclio)的请求/响应时长与吞吐量

方法1:Grafana中的Nuclio专属面板

在Iguazio的Grafana实例中,直接定位Nuclio内置指标面板:

  • 登录Grafana后,点击左侧菜单栏「Dashboards」→「Browse」
  • 搜索框输入nuclio,找到「Nuclio Functions」或「Nuclio Function Metrics」类面板
  • 进入面板后选择目标函数nuclio-risk-sentiment,即可查看核心指标:
    • nuclio_invocation_duration_seconds:请求处理总时长(含排队+执行),支持查看P95/P99分位数、平均值
    • nuclio_invocation_count_total:累计请求数,结合时间范围可直接计算吞吐量(请求数/时间跨度)
    • nuclio_queue_duration_seconds:请求排队等待时长,用于区分是排队延迟还是执行延迟

方法2:MLRun CLI拉取函数指标

如果Grafana面板未找到,可通过MLRun命令行直接获取:

  • 先确认函数状态:mlrun function get nuclio-risk-sentiment
  • 拉取实时指标:mlrun function metrics nuclio-risk-sentiment
    返回结果中,invocation_duration对应请求响应时长,invocation_count可用于计算吞吐量

方法3:直接访问Nuclio函数的指标端点

运行中的Nuclio函数默认暴露Prometheus指标端点:

  • 通过kubectl get pods -n <your-namespace>获取函数Pod IP(Iguazio默认命名空间为default)
  • 访问http://<pod-ip>:8080/metrics,在返回内容中搜索:
    • nuclio_invocation_duration_seconds_bucket:时长直方图数据,用于计算分位数
    • nuclio_invocation_count_total:累计请求数,除以时间跨度得到吞吐量

注意事项

  • MLRun部署实时函数时默认开启指标采集,无需额外配置
  • 多租户环境下需确认拥有对应函数的指标访问权限

内容的提问来源于stack exchange,提问作者JzD

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.19 03:08:08