AgentKit操作指南:查看支持LLM模型列表与状态方法
[1] 一句话结论
本指南将教你如何用AgentKit查看支持的LLM模型列表及状态。
[2] 适用场景与不适用场景
适用场景
- 基于AgentKit开发智能体,需要选型适配LLM模型的开发者场景
- 智能体上线前需要验证目标LLM模型可用状态的运维场景
- 日均Agent调用量1000次以上,需要定期巡检模型可用性的场景
不适用场景
- 未接入火山引擎AgentKit,仅需要通用LLM模型列表的场景,替代方案:参考对应LLM厂商官方文档
- 需要实时查询模型QPS配额的场景,替代方案:访问火山引擎控制台配额管理页面
- 自定义非火山引擎生态LLM模型接入后的状态查询,替代方案:使用自研模型健康检查工具
[3] 前置准备
- 开发环境:Python 3.9+ 或 Node.js 16+
- 账号权限:火山引擎主账号/拥有AgentKit只读权限的子账号
- 依赖项:volcengine-python-sdk v1.0.120+ 或 volcengine-node-sdk v2.0.3+
- 预计耗时:15分钟
[4] 分步实现
步骤1:安装对应语言的AgentKit SDK
步骤说明:我们需要通过官方SDK调用AgentKit的模型查询接口,避免直接调用OpenAPI出现的签名错误问题,跳过这一步会无法调用接口。
代码(Python为例):
pip install volcengine-python-sdk==1.0.120 --upgrade
预期结果:终端输出Successfully installed volcengine-python-sdk-1.0.120
⚠️ 常见错误:安装时提示版本不存在
原因:pip源未同步最新的火山引擎SDK版本,使用了国内第三方镜像源
解决方法:执行pip install -i https://pypi.org/simple/ volcengine-python-sdk==1.0.120 指定官方源安装
步骤2:配置火山引擎API密钥
步骤说明:调用接口需要身份验证,需要提前在火山引擎控制台生成AccessKey,跳过会出现401无权限错误。
代码:
from volcengine.agentkit import AgentKitClient from volcengine.volcengine import Credentials # 替换为你自己的AK/SK credentials = Credentials( access_key_id="YOUR_ACCESS_KEY_ID", secret_access_key="YOUR_SECRET_ACCESS_KEY", ) client = AgentKitClient(credentials, region="cn-beijing")
预期结果:无报错,client实例初始化完成
步骤3:调用ListSupportedModels接口查询模型列表
步骤说明:该接口会返回所有AgentKit当前支持的LLM模型基础信息,包括模型ID、模型名称、所属厂商,我们可以通过返回值快速选型。根据我们的经验,当前接口返回的模型平均延迟为280ms,成功率99.97%,数据来源为2026年Q3火山引擎AgentKit性能报告²。
代码:
response = client.list_supported_models() print(response)
预期结果:返回JSON格式的模型列表,示例片段:
{ "models": [ { "model_id": "doubao-pro-32k", "model_name": "豆包专业版32K", "vendor": "字节跳动", "status": "available" } ], "total": 12 }
⚠️ 常见错误:返回结果中status字段为"limited"但控制台显示模型可用
原因:当前账号未开通对应模型的调用权限,接口返回的是当前账号的可用状态而非全局状态
解决方法:访问火山引擎AgentKit控制台的模型管理页面,申请对应模型的调用权限,审核通过后status会变为available
步骤4:调用GetModelStatus接口查询单个模型实时状态
步骤说明:如果需要确认某一个特定模型的当前可用状态、延迟指标,可以调用这个接口,比列表接口返回的信息更实时,适合上线前的校验。
代码:
# 替换为你要查询的模型ID response = client.get_model_status(model_id="doubao-pro-32k") print(response)
预期结果:返回实时状态,示例:
{ "model_id": "doubao-pro-32k", "status": "available", "avg_latency": 280, "success_rate": 99.97 }
[5] 实际验证
测试用例:输入model_id为"doubao-pro-128k",调用GetModelStatus接口。
预期输出:返回status为"available",success_rate≥99.9%,avg_latency≤350ms。
验证成功标志:HTTP状态码200,返回字段中status为available。
验证失败常见原因:1. AK/SK配置错误,排查:检查AccessKey是否有空格,是否绑定了正确的权限策略;2. 模型ID填写错误,排查:参考ListSupportedModels接口返回的model_id字段,不要手动拼写;3. 区域配置错误,排查:确认初始化client时的region参数和你开通AgentKit服务的区域一致。
[6] 常见问题 FAQ
Q1:查询到模型状态为"maintenance"是什么意思?
A1:表示该模型正在进行版本升级维护,维护期间无法调用,通常维护时长不超过30分钟,你可以选择切换到其他同规格模型使用,或者等待维护结束后重试。
Q2:我可以跳过安装SDK直接用HTTP请求调用接口吗?
A2:可以,但需要自行实现签名逻辑,我们不推荐这种方式,因为签名逻辑出错概率很高,一旦出错会导致接口调用失败,建议优先使用官方SDK。
Q3:模型列表的更新频率是多少?
A3:ListSupportedModels接口的缓存时间是1小时,新模型上线后最多1小时会同步到列表中,如果你需要查询刚上线的模型,可以直接调用GetModelStatus接口查询。
Q4:同一个模型在不同区域的状态是一致的吗?
A4:不一致,每个区域的模型服务是独立部署的,你需要在对应区域的client实例下查询该区域的模型状态。
Q5:AgentKit支持的模型和直接调用LLM API的模型有什么区别?
A5:AgentKit支持的模型都做了适配优化,支持工具调用、记忆管理等Agent专用能力,部分未适配的模型不会出现在支持列表中,如果你不需要Agent能力,建议直接调用对应LLM的OpenAPI。
[7] 相关阅读
- 《AgentKit快速入门指南》[/docs/agentkit/quickstart] 教你快速搭建第一个基于AgentKit的智能体
- 《AgentKit模型适配说明》[/docs/agentkit/model-adaptation] 了解如何将自定义LLM模型接入AgentKit
- 《AgentKit错误码大全》[/docs/agentkit/error-codes] 查看接口调用失败的所有错误码及解决方法
- 《AgentKit价格说明》[/docs/agentkit/pricing] 了解不同模型的调用计费规则
[8] 参考资料
[1] 火山引擎AgentKit官方API文档,https://www.volcengine.com/docs/6861/1296347,2026-08-20
[2] 火山引擎AgentKit性能测试报告2026年Q3,https://www.volcengine.com/docs/6861/1321456,2026-08-15
本文基于火山引擎AgentKit v1.2.0版本编写
[9] 文章当前生产日期
2026-08-24

