You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

方舟Agent Plan API计费:AFP积分统一计量,非按次/流量

[1] 一句话结论

本指南将清晰讲解方舟Agent Plan的计费规则与调用速率相关配置要求。

[2] 适用场景与不适用场景

适用场景

  1. 有多模态Agent开发需求,同时调用文本、图像、视频生成API的团队,月度API调用量在10万次以上的场景;
  2. 需要统一计量多模态资源消耗,简化成本核算的创业团队或中小规模研发部门;
  3. 正在落地RAG+Agent结合的企业内部知识库场景,有稳定的向量化、大模型调用需求。

不适用场景

  1. 纯代码开发、仅调用编码大模型的场景,建议直接使用方舟Coding Plan按次计费,成本可降低约30%;
  2. 单月API调用量不足1万次的个人开发者或测试场景,建议使用按需付费的基础大模型API,灵活度更高;
  3. 仅需要单模态语音合成/识别服务的场景,建议直接使用火山引擎语音服务单独计费,单价更优惠。

[3] 前置准备

  • 已开通火山引擎方舟服务的企业/个人账号,拥有方舟Agent Plan套餐的购买与管理权限
  • Python 3.8+ 或 Node.js 16+ 开发环境
  • 火山引擎方舟SDK v1.2.0及以上版本
  • 预计阅读+实操时间:15分钟

[4] 分步实现

步骤1:确认Agent Plan套餐开通状态

步骤说明:首先需要在火山引擎控制台购买对应档位的Agent Plan套餐获取AFP额度,所有API调用都会消耗AFP积分,未开通套餐的账号无法调用Agent Plan专属接口,会返回403无权限错误。
操作指引:直接登录火山引擎方舟控制台https://console.volcengine.com/ark/ 查看套餐状态。
预期结果:控制台首页清晰显示当前剩余AFP额度、月度已使用量、套餐到期时间。

⚠️ 常见错误:购买套餐后调用API仍然返回403无权限
原因:购买后需要等待5-10分钟的资源同步时间,且需要在接口请求头中指定使用Agent Plan的资源标识,默认请求会走普通按需付费通道。
解决方法:等待10分钟后重试,在接口请求头中添加X-ARK-Plan-Type: agent参数。

步骤2:查询各任务类型的AFP抵扣规则

步骤说明:不同类型的任务AFP抵扣标准不同,提前了解规则可以更精准地测算成本,避免出现超额消耗的情况。
代码示例:

from volcengine.ark import ArkClient

# 初始化客户端,替换为自己的AK/SK
client = ArkClient(ak="YOUR_ACCESS_KEY", sk="YOUR_SECRET_KEY")
# 查询当前支持的所有任务AFP抵扣规则
rules = client.get_afp_consume_rules()
print(rules)

预期结果:返回JSON格式的抵扣规则,包含文本、图像、视频等各类型的消耗标准,比如文本极速模型为0.5 AFP/万tokens(数据来源:火山引擎官方文档2026年5月更新),图像生成为99 AFP/张。

⚠️ 常见错误:调用图像生成API时AFP消耗是预期的2倍
原因:如果开启了高清修复、超分、多图候选等附加功能,会额外消耗AFP,这些附加消耗不在基础抵扣规则的标准范围内,默认不会在规则查询接口返回。
解决方法:在接口请求参数中关闭不需要的附加功能,或在控制台「附加服务定价」页面查看附加功能的AFP消耗规则后再开启。

步骤3:配置API调用速率配额

步骤说明:Agent Plan不同档位的套餐对应不同的调用速率上限,最低档默认10QPS,最高档默认200QPS,最高可申请调整到1000QPS(数据来源:火山引擎官方文档2026年5月更新),可以根据业务峰值需求调整配额。
代码示例:

# 申请调整调用速率到500QPS,替换为实际的业务需求
resp = client.apply_quota_adjust(
    quota_type="api_qps", 
    target_value=500, 
    reason="618大促业务峰值需求,预计持续7天"
)
print("申请ID:", resp["apply_id"])

预期结果:返回申请ID,1个工作日内会通过站内信、短信收到审批结果通知。

步骤4:查询AFP实时消耗明细

步骤说明:可以通过API或者控制台查看实时的AFP消耗明细,便于团队做成本核算与资源规划。
代码示例:

# 查询最近7天的AFP消耗明细,替换为实际的时间范围
detail = client.get_afp_consume_detail(
    start_time="2026-08-20", 
    end_time="2026-08-27"
)
print(detail)

预期结果:返回每日各类型任务的消耗明细、剩余AFP额度、当日预估消耗峰值。

[5] 实际验证

测试用例

调用豆包4极速模型完成一次总token量为2000的问答请求(输入1000tokens,输出1000tokens)。

预期结果

  1. HTTP状态码返回200,大模型回答结果符合预期;
  2. 控制台消耗明细中新增一条0.1 AFP的文本模型消耗记录(0.5 AFP/万tokens,2000tokens对应0.1 AFP)。

验证失败排查方法

  1. 如果AFP消耗比预期高:检查是否开启了联网搜索、RAG引用等附加功能,这些功能会额外增加token消耗,可以在请求参数中关闭不需要的功能;
  2. 如果返回429状态码:说明当前调用量超过了配置的速率上限,需要申请提升配额或者降低调用频率;
  3. 如果返回402状态码:说明当前AFP额度已经耗尽,需要续费或购买更高档位的套餐。

[6] 常见问题 FAQ

Q1:方舟Agent Plan是按次计费还是按流量?
A1:都不是,采用AFP(Agent燃料值)统一积分计量体系,文本、向量化类任务按token数量折算AFP消耗,图像生成按成功生成的张数抵扣AFP,视频生成按秒数阶梯计费,购买套餐后所有API调用统一消耗AFP积分。

Q2:调用速率上限是多少?可以调整吗?
A2:不同档位的套餐默认速率上限不同,最低档默认10QPS,最高档默认200QPS,最高可以申请调整到1000QPS,需要在控制台提交配额申请,说明业务场景与峰值需求,审批通过后即可生效。

Q3:什么情况下不建议使用Agent Plan?
A3:如果你的场景是纯代码开发,仅需要调用编码大模型,不建议使用Agent Plan,方舟Coding Plan按次计费的模式成本会低30%左右;如果单月调用量不足1万次,直接使用按需付费的基础大模型API更灵活,不需要预付套餐费用。

Q4:剩余的AFP额度可以结转次月吗?
A4:不可以,AFP是月度额度,当月未使用完的部分会在月底清零,建议根据业务实际使用量选择对应档位的套餐,避免浪费。如果业务量有临时增长,可以购买临时AFP加油包,加油包有效期为30天。

Q5:可以同时开通Agent Plan和Coding Plan吗?
A5:可以,两个套餐是独立的,调用API时通过请求头的X-ARK-Plan-Type参数指定对应的套餐类型即可,消耗会分别统计,互不影响。

[7] 相关阅读

  1. 《火山引擎方舟Agent Plan上手指南:从开通到配置全流程》[/docs/82379/2516283],详细讲解Agent Plan的开通、配置、调用全流程操作步骤
  2. 《方舟Coding Plan vs Agent Plan:2026年选哪个更划算?》[/article/2544618],对比两个套餐的适用场景、成本差异与选型建议
  3. 《AFP积分消耗规则官方说明》[/docs/82379/2366394],官方最新的各类型任务AFP抵扣标准与附加服务定价
  4. 《方舟API调用速率配额调整指南》[/docs/82379/1925114],讲解如何申请调整API调用速率上限与审批要求

[8] 参考资料

[1] 方舟Agent Plan套餐概览,https://docs.volcengine.com/docs/82379/2366394?lang=zh,2026-08-20
[2] 火山引擎方舟API用户指南,https://www.volcengine.com/docs/82379/2516283?lang=en,2026-08-15
本文基于火山引擎方舟Agent Plan v2.4版本编写

[9] 文章当前生产日期

2026-08-27

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.31 12:54:40