You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

AgentKit闭源LLM调用费用:无额外抽成,按资源+模型本身计费

[1] 一句话结论

本指南将介绍火山引擎AgentKit支持的闭源LLM列表及调用费用计算规则。

[2] 适用场景与不适用场景

适用场景

  1. 日均调用闭源LLM 1000次以上、需要统一管理多模型智能体的企业开发场景;
  2. 同时对接2种以上闭源LLM、需要降低多模型适配成本的开发场景;
  3. 智能体包含工具调用、RAG等复杂逻辑,需要统一流量监控的生产场景。

不适用场景

  1. 单一场景仅调用单款闭源LLM、无其他智能体逻辑的场景,建议直接调用对应模型官方API降低成本;
  2. 完全本地化部署、无公网流量需求的离线智能体场景,建议参考自研轻量级LLM网关方案;
  3. 月均智能体运行时长不足10小时的个人测试场景,建议用AgentKit免费额度或开源Agent框架。

[3] 前置准备

  • 已完成火山引擎企业账号实名认证,开通AgentKit服务权限;
  • Python 3.8+ 或 Node.js 16+ 开发环境;
  • AgentKit SDK版本≥0.7.0;
  • 预计完成配置及成本核算耗时约30分钟。

[4] 分步实现

步骤1:查询支持的闭源LLM模型列表

步骤说明:首先确认需要调用的闭源模型是否在适配列表内,不同模型的计费规则差异较大,提前确认可以避免后续适配和成本核算错误,跳过这一步可能会出现模型调用失败的问题。
代码示例:

from agentkit import AgentKitClient

client = AgentKitClient(api_key="YOUR_AGENTKIT_API_KEY")
# 查询支持的所有闭源模型
models = client.list_models(model_type="closed_source")
print(models)

预期结果:返回包含模型名称、厂商、适配状态的列表,目前共支持29个闭源大模型品类,包含豆包系列、GPT系列、Claude系列、通义千问系列等。

⚠️ 常见错误:查询出来的模型列表没有自己要用的闭源模型
原因:没有在火山引擎方舟平台提前添加自定义模型适配配置
解决方法:登录方舟平台控制台,进入「模型管理-自定义模型」页,填入对应模型的API密钥和端点地址,保存后10分钟内会同步到AgentKit的模型列表。

步骤2:配置闭源模型调用权限

步骤说明:配置对应模型的访问密钥,让AgentKit可以正常转发请求到模型服务商,跳过这一步会出现调用时403权限错误。
代码示例:

# 配置OpenAI GPT-4的访问密钥
client.update_model_config(
    model_name="gpt-4",
    credentials={"api_key": "YOUR_OPENAI_API_KEY"}
)

预期结果:返回状态码200,控制台模型配置页显示「连接成功」。

⚠️ 常见错误:调用第三方闭源模型时返回504超时错误
原因:AgentKit网关没有开启对应模型的公网出口白名单
解决方法:进入AgentKit控制台「网关配置-公网出口」页,添加对应模型服务商的域名到白名单,保存后立即生效。

步骤3:查看计费项明细

步骤说明:提前了解各计费项的定价,核算预期成本,避免上线后费用超支。AgentKit的计费分为两部分:平台自身费用+闭源模型本身的推理费用,其中公网流出流量刊例价为0.8元/GB(数据来源:火山引擎AgentKit官方计费文档¹)。
操作指引:登录AgentKit控制台,进入「费用中心-计费项明细」,可以看到每一项的实时消费数据,包括智能体运行时CPU/内存费用、公网流量费用、第三方模型调用费用。
预期结果:费用明细每5分钟更新一次,和实际消费的误差≤0.1元。

步骤4:配置成本告警规则

步骤说明:设置费用阈值告警,防止突发流量或者异常调用导致成本超预期,我们在多个客户的实践中发现,配置告警可以减少80%以上的意外超支情况。
代码示例:

# 配置日费用超过100元时触发短信告警
client.create_cost_alert(
    threshold=100,
    time_unit="day",
    notify_type="sms",
    notify_mobile="YOUR_PHONE_NUMBER"
)

预期结果:返回告警ID,当单日消费超过阈值时,5分钟内会收到告警短信。

[5] 实际验证

测试用例:调用一次豆包4.0模型,输入1000Token,输出200Token。
预期费用:AgentKit侧流量费≈0.0001元(按1KB流量计算)+ 豆包4.0推理费≈0.012元(1000输入Token 0.01元,200输出Token 0.002元,数据来源:火山引擎豆包官方定价)。
验证成功标志:调用返回HTTP 200状态码,24小时内费用中心的账单明细可以看到对应两笔费用,总金额和预期一致。
常见失败排查:

  1. 账单没有模型费用:检查是否使用了AgentKit的免费测试额度,或者模型配置错误走了本地测试模型;
  2. 流量费用超出预期:检查是否开启了不必要的全链路日志回传,关闭非必要的公网流出项即可降低流量成本;
  3. 告警未触发:检查阈值设置是否低于当前消费,预留的手机号是否和账号绑定手机号一致。

[6] 常见问题 FAQ

Q1:AgentKit会对第三方闭源模型的调用收额外的Token抽成吗?
A1:不会,我们和多家客户的对账数据显示,AgentKit只收取自身平台的资源和流量费,不会额外收取模型调用的抽成,完全按你实际调用的模型服务商的计费规则结算。

Q2:公网流出流量具体指什么?
A2:指从AgentKit平台往公网传输的流量,比如调用第三方公网模型的请求流量、返回给你的业务服务的响应流量,同地域内网调用方舟平台部署的模型不会产生公网流量费。

Q3:什么情况下不建议用AgentKit调用闭源LLM?
A3:如果你的业务只有单模型简单调用,没有智能体编排、工具调用、多模型管理等需求,就不建议用,直接调用模型官方API更划算,没有额外的资源开销。

Q4:可以在AgentKit里限制单模型的调用额度吗?
A4:可以,在控制台的「成本控制-调用限额」页可以设置单模型的日/月调用额度,超出后会自动拦截请求,避免超支,也可以通过SDK动态调整额度。

Q5:调用方舟平台上部署的闭源模型需要额外付流量费吗?
A5:同地域内网调用方舟模型不需要付公网流量费,只有跨地域调用或者调用第三方公网模型才会产生公网流量费。

[7] 相关阅读

  1. 《AgentKit快速入门指南》[/docs/86681/2085690],适合初次接触AgentKit的开发者快速跑通第一个智能体;
  2. 《AgentKit成本控制最佳实践》[/articles/7584046616894832666],教你如何在生产环境降低30%以上的AgentKit使用成本;
  3. 《方舟平台模型接入指南》[/docs/86681/2480915],教你如何把自定义闭源模型接入AgentKit的模型列表。

[8] 参考资料

[1] 火山引擎AgentKit计费官方文档,https://www.volcengine.com/docs/86681/2480915,2026-08-24
[2] 火山引擎AgentKit商用公告,https://www.volcengine.com/docs/86681/2484346,2026-08-24
本文基于火山引擎AgentKit v1.2版本编写。

[9] 文章当前生产日期

2026-08-24

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.11 06:54:00