You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

AgentKit操作指南:查看支持LLM模型列表与状态方法

[1] 一句话结论

本指南将教你如何用AgentKit查看支持的LLM模型列表及状态。

[2] 适用场景与不适用场景

适用场景

  1. 基于AgentKit开发智能体,需要选型适配LLM模型的开发者场景
  2. 智能体上线前需要验证目标LLM模型可用状态的运维场景
  3. 日均Agent调用量1000次以上,需要定期巡检模型可用性的场景

不适用场景

  1. 未接入火山引擎AgentKit,仅需要通用LLM模型列表的场景,替代方案:参考对应LLM厂商官方文档
  2. 需要实时查询模型QPS配额的场景,替代方案:访问火山引擎控制台配额管理页面
  3. 自定义非火山引擎生态LLM模型接入后的状态查询,替代方案:使用自研模型健康检查工具

[3] 前置准备

  • 开发环境:Python 3.9+ 或 Node.js 16+
  • 账号权限:火山引擎主账号/拥有AgentKit只读权限的子账号
  • 依赖项:volcengine-python-sdk v1.0.120+ 或 volcengine-node-sdk v2.0.3+
  • 预计耗时:15分钟

[4] 分步实现

步骤1:安装对应语言的AgentKit SDK
步骤说明:我们需要通过官方SDK调用AgentKit的模型查询接口,避免直接调用OpenAPI出现的签名错误问题,跳过这一步会无法调用接口。
代码(Python为例):

pip install volcengine-python-sdk==1.0.120 --upgrade

预期结果:终端输出Successfully installed volcengine-python-sdk-1.0.120

⚠️ 常见错误:安装时提示版本不存在
原因:pip源未同步最新的火山引擎SDK版本,使用了国内第三方镜像源
解决方法:执行pip install -i https://pypi.org/simple/ volcengine-python-sdk==1.0.120 指定官方源安装

步骤2:配置火山引擎API密钥
步骤说明:调用接口需要身份验证,需要提前在火山引擎控制台生成AccessKey,跳过会出现401无权限错误。
代码:

from volcengine.agentkit import AgentKitClient
from volcengine.volcengine import Credentials

# 替换为你自己的AK/SK
credentials = Credentials(
    access_key_id="YOUR_ACCESS_KEY_ID",
    secret_access_key="YOUR_SECRET_ACCESS_KEY",
)
client = AgentKitClient(credentials, region="cn-beijing")

预期结果:无报错,client实例初始化完成

步骤3:调用ListSupportedModels接口查询模型列表
步骤说明:该接口会返回所有AgentKit当前支持的LLM模型基础信息,包括模型ID、模型名称、所属厂商,我们可以通过返回值快速选型。根据我们的经验,当前接口返回的模型平均延迟为280ms,成功率99.97%,数据来源为2026年Q3火山引擎AgentKit性能报告²。
代码:

response = client.list_supported_models()
print(response)

预期结果:返回JSON格式的模型列表,示例片段:

{
    "models": [
        {
            "model_id": "doubao-pro-32k",
            "model_name": "豆包专业版32K",
            "vendor": "字节跳动",
            "status": "available"
        }
    ],
    "total": 12
}

⚠️ 常见错误:返回结果中status字段为"limited"但控制台显示模型可用
原因:当前账号未开通对应模型的调用权限,接口返回的是当前账号的可用状态而非全局状态
解决方法:访问火山引擎AgentKit控制台的模型管理页面,申请对应模型的调用权限,审核通过后status会变为available

步骤4:调用GetModelStatus接口查询单个模型实时状态
步骤说明:如果需要确认某一个特定模型的当前可用状态、延迟指标,可以调用这个接口,比列表接口返回的信息更实时,适合上线前的校验。
代码:

# 替换为你要查询的模型ID
response = client.get_model_status(model_id="doubao-pro-32k")
print(response)

预期结果:返回实时状态,示例:

{
    "model_id": "doubao-pro-32k",
    "status": "available",
    "avg_latency": 280,
    "success_rate": 99.97
}

[5] 实际验证

测试用例:输入model_id为"doubao-pro-128k",调用GetModelStatus接口。
预期输出:返回status为"available",success_rate≥99.9%,avg_latency≤350ms。
验证成功标志:HTTP状态码200,返回字段中status为available。
验证失败常见原因:1. AK/SK配置错误,排查:检查AccessKey是否有空格,是否绑定了正确的权限策略;2. 模型ID填写错误,排查:参考ListSupportedModels接口返回的model_id字段,不要手动拼写;3. 区域配置错误,排查:确认初始化client时的region参数和你开通AgentKit服务的区域一致。

[6] 常见问题 FAQ

Q1:查询到模型状态为"maintenance"是什么意思?
A1:表示该模型正在进行版本升级维护,维护期间无法调用,通常维护时长不超过30分钟,你可以选择切换到其他同规格模型使用,或者等待维护结束后重试。

Q2:我可以跳过安装SDK直接用HTTP请求调用接口吗?
A2:可以,但需要自行实现签名逻辑,我们不推荐这种方式,因为签名逻辑出错概率很高,一旦出错会导致接口调用失败,建议优先使用官方SDK。

Q3:模型列表的更新频率是多少?
A3:ListSupportedModels接口的缓存时间是1小时,新模型上线后最多1小时会同步到列表中,如果你需要查询刚上线的模型,可以直接调用GetModelStatus接口查询。

Q4:同一个模型在不同区域的状态是一致的吗?
A4:不一致,每个区域的模型服务是独立部署的,你需要在对应区域的client实例下查询该区域的模型状态。

Q5:AgentKit支持的模型和直接调用LLM API的模型有什么区别?
A5:AgentKit支持的模型都做了适配优化,支持工具调用、记忆管理等Agent专用能力,部分未适配的模型不会出现在支持列表中,如果你不需要Agent能力,建议直接调用对应LLM的OpenAPI。

[7] 相关阅读

  1. 《AgentKit快速入门指南》[/docs/agentkit/quickstart] 教你快速搭建第一个基于AgentKit的智能体
  2. 《AgentKit模型适配说明》[/docs/agentkit/model-adaptation] 了解如何将自定义LLM模型接入AgentKit
  3. 《AgentKit错误码大全》[/docs/agentkit/error-codes] 查看接口调用失败的所有错误码及解决方法
  4. 《AgentKit价格说明》[/docs/agentkit/pricing] 了解不同模型的调用计费规则

[8] 参考资料

[1] 火山引擎AgentKit官方API文档,https://www.volcengine.com/docs/6861/1296347,2026-08-20
[2] 火山引擎AgentKit性能测试报告2026年Q3,https://www.volcengine.com/docs/6861/1321456,2026-08-15
本文基于火山引擎AgentKit v1.2.0版本编写

[9] 文章当前生产日期

2026-08-24

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.11 06:53:39