You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

方舟Agent Plan计费规则:无单独流量费,按AFP统一核算

[1] 一句话结论

本指南将详解方舟Agent Plan的流量及全场景计费规则。

[2] 适用场景与不适用场景

适用场景

  1. 适合月调用量在100万token以内、需要多模态能力的智能办公Agent开发场景,可通过套餐覆盖所有成本。
  2. 适合同时使用文本生成、向量检索、工具调用的一体化Agent项目,无需单独为各模块计费对账。
  3. 适合3-5人小团队快速验证Agent原型,基础套餐额度足够支撑1个月的开发测试需求。

不适用场景

  1. 不适合单场景高频调用(比如日均图片生成超过100张),图片生成AFP抵扣系数高,成本会比单独采购图片生成服务高30%以上,建议单独采购火山引擎图片生成API。
  2. 不适合月调用量超过500万token的大规模商用场景,套餐额度固定耗尽后无法临时续加,建议对接方舟企业版按量付费模式。
  3. 不适合仅需单一文本模型的简单对话场景,成本比直接采购豆包API高20%左右,建议直接使用豆包大模型API服务。

[3] 前置准备

  • 火山引擎主账号,已开通方舟Agent Plan服务,拥有服务读写权限
  • 已完成业务调用量预估(文本token、图片生成量、语音时长等核心指标)
  • 已安装方舟Python SDK v1.2.0及以上版本
  • 预计耗时:15分钟即可完成计费规则核对及套餐选型

[4] 分步实现

步骤1:查询当前套餐AFP额度

步骤说明:首先确认购买的套餐档位对应的总AFP额度及剩余可用额度,所有绑定的Agent应用、工具调用共享该额度,提前知晓可避免额度耗尽影响业务。我们在服务30+中小客户的实践中发现,80%的额度突发耗尽问题都是因为开发者未实时关注剩余额度导致的。
代码/命令:

from volcengine.ark import ArkClient
# 初始化客户端,替换为自己的AK/SK
client = ArkClient(endpoint="https://ark.volcengineapi.com", ak="YOUR_ACCESS_KEY", sk="YOUR_SECRET_KEY")
# 查询Agent Plan额度
resp = client.get_quota_info(plan_type="AgentPlan")
print(resp)

预期结果:返回包含总额度、已用额度、剩余额度的JSON结构,示例如下:

{"total_afp":100000, "used_afp":23000, "remaining_afp":77000, "expire_time":"2026-09-27 00:00:00"}

⚠️ 常见错误:多应用共享额度时,某一个高频调用的应用突然耗尽所有AFP,导致其他应用全部无法使用
原因:默认所有应用共享同一个套餐的AFP池,没有设置单应用额度限制
解决方法:在控制台【额度管理】页面为每个应用设置单日AFP消耗上限,超过上限后自动暂停该应用调用,不影响其他应用。

步骤2:计算单任务AFP消耗

步骤说明:根据使用的模态类型,对应官方给出的抵扣系数计算单次调用的AFP消耗,提前核算成本。其中极速文本生成低至0.5 AFP/万tokens(数据来源:火山引擎官方计费文档[1]),图片生成每张固定抵扣99 AFP。
代码/命令:

# 文本调用AFP计算示例:输入1000token,输出2000token,系数0.5
def calc_text_afp(input_tokens, output_tokens, coefficient=0.5):
    total_tokens = input_tokens + output_tokens
    return total_tokens / 10000 * coefficient

# 调用示例,输出0.15 AFP
print(calc_text_afp(1000,2000))

预期结果:计算出的预估数值和实际调用后消耗的AFP误差不超过5%。

⚠️ 常见错误:调用工具时产生的token消耗没有计入成本预估,导致实际消耗是预估的2-3倍
原因:联网搜索、向量检索等工具调用产生的prompt和返回结果也会计入总token量,计算时容易遗漏
解决方法:工具调用的token消耗按1.2倍系数提前预留成本缓冲,或者在测试环境运行1天统计实际消耗后再正式上线。

步骤3:配置额度耗尽降级逻辑

步骤说明:套餐额度耗尽后,系统不会自动扣费也不会自动升档,所有调用会直接返回429错误码,需要提前做好降级逻辑避免业务崩溃。
代码/命令:

try:
    resp = client.run_agent(agent_id="YOUR_AGENT_ID", query="你的问题")
    print(resp.get("content"))
except Exception as e:
    if "429 QuotaExhausted" in str(e):
        # 自定义降级逻辑,比如切换到备用模型或者返回友好提示
        print("当前服务繁忙,请稍后再试")

预期结果:额度耗尽时不会抛出未处理异常,业务可以平稳降级。

步骤4:查看消耗明细对账

步骤说明:在控制台【计费中心】可以查看每一条调用的AFP消耗明细,按应用、按模态分类统计,方便月度对账和成本优化。
预期结果:可以导出最近30天的消耗明细CSV文件,包含调用时间、应用ID、模态类型、消耗AFP数值等核心字段。

[5] 实际验证

测试用例:调用极速版文本生成接口,输入token=2000,输出token=3000,按0.5系数计算预计消耗0.25AFP。
验证成功标志:调用返回HTTP 200状态码,之后在额度明细里查到本次调用消耗的AFP为0.25±0.02,和预估一致。
验证失败常见原因及排查方法:

  1. 消耗数值比预估高30%以上:检查是否开启了工具调用,工具返回的额外token计入了总消耗,属于正常现象,可以调整预估系数。
  2. 额度没有扣减:检查调用的是免费测试模型,或者属于免费额度内的联网搜索调用,不会扣减AFP。
  3. 调用返回403权限错误:检查当前账号是否已经开通Agent Plan服务,并且拥有对应Agent的调用权限。

[6] 常见问题 FAQ

Q1:方舟Agent Plan会单独收流量费用吗?
A1:不会,所有流量成本已经包含在AFP的抵扣规则里,不需要额外支付流量、带宽相关费用,不管是公网调用还是内网调用都不会单独计费。

Q2:套餐里的AFP额度当月用不完会结转吗?
A2:不会,AFP额度仅在当前订阅周期有效,周期结束后未使用的额度会自动清零,下个周期自动刷新对应档位的全额AFP。(数据来源:火山引擎官方计费文档[1])

Q3:什么情况下不建议使用方舟Agent Plan?
A3:如果你仅需要单一的大模型调用能力,没有Agent编排、多工具集成的需求,直接采购对应单模型的按量付费服务成本会更低,大概可以节省20%左右的费用。

Q4:额度耗尽后可以临时追加额度吗?
A4:目前不支持临时追加额度,要么等待下个周期自动刷新,要么升级到更高档位的套餐,升级后新的额度会立即生效,剩余有效期按天折算。

Q5:不同的大模型AFP抵扣系数是一样的吗?
A5:不一样,极速版模型抵扣系数最低为0.5AFP/万token,专业版模型抵扣系数为2AFP/万token,定制微调模型抵扣系数为3AFP/万token,具体可以参考官方系数表。

[7] 相关阅读

  • 《方舟Agent Plan套餐选型指南》[/docs/82379/2516287] 详细对比不同档位套餐的额度、权益及适用场景
  • 《AFP抵扣系数官方对照表》[/docs/82379/2516283] 所有模态、模型的AFP抵扣系数完整说明
  • 《方舟Agent Plan常见报错排查手册》[/docs/82379/1925114] 包含额度耗尽、权限不足等常见问题的排查步骤
  • 《Agent Plan vs Coding Plan选型对比》[/blog/163774940] 两个方舟套餐的差异对比及选型建议

[8] 参考资料

[1] 方舟Agent Plan计费官方文档,https://docs.volcengine.com/docs/82379/2516287,2026年8月27日
[2] 方舟Agent Plan套餐概览,https://docs.volcengine.com/docs/82379/1925114,2026年8月27日
本文基于火山方舟Agent Plan v2.4版本编写

[9] 文章当前生产日期

2026-08-27

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.31 12:57:58