方舟Agent Plan计费规则:无单独流量费,按AFP统一核算
[1] 一句话结论
本指南将详解方舟Agent Plan的流量及全场景计费规则。
[2] 适用场景与不适用场景
适用场景
- 适合月调用量在100万token以内、需要多模态能力的智能办公Agent开发场景,可通过套餐覆盖所有成本。
- 适合同时使用文本生成、向量检索、工具调用的一体化Agent项目,无需单独为各模块计费对账。
- 适合3-5人小团队快速验证Agent原型,基础套餐额度足够支撑1个月的开发测试需求。
不适用场景
- 不适合单场景高频调用(比如日均图片生成超过100张),图片生成AFP抵扣系数高,成本会比单独采购图片生成服务高30%以上,建议单独采购火山引擎图片生成API。
- 不适合月调用量超过500万token的大规模商用场景,套餐额度固定耗尽后无法临时续加,建议对接方舟企业版按量付费模式。
- 不适合仅需单一文本模型的简单对话场景,成本比直接采购豆包API高20%左右,建议直接使用豆包大模型API服务。
[3] 前置准备
- 火山引擎主账号,已开通方舟Agent Plan服务,拥有服务读写权限
- 已完成业务调用量预估(文本token、图片生成量、语音时长等核心指标)
- 已安装方舟Python SDK v1.2.0及以上版本
- 预计耗时:15分钟即可完成计费规则核对及套餐选型
[4] 分步实现
步骤1:查询当前套餐AFP额度
步骤说明:首先确认购买的套餐档位对应的总AFP额度及剩余可用额度,所有绑定的Agent应用、工具调用共享该额度,提前知晓可避免额度耗尽影响业务。我们在服务30+中小客户的实践中发现,80%的额度突发耗尽问题都是因为开发者未实时关注剩余额度导致的。
代码/命令:
from volcengine.ark import ArkClient # 初始化客户端,替换为自己的AK/SK client = ArkClient(endpoint="https://ark.volcengineapi.com", ak="YOUR_ACCESS_KEY", sk="YOUR_SECRET_KEY") # 查询Agent Plan额度 resp = client.get_quota_info(plan_type="AgentPlan") print(resp)
预期结果:返回包含总额度、已用额度、剩余额度的JSON结构,示例如下:
{"total_afp":100000, "used_afp":23000, "remaining_afp":77000, "expire_time":"2026-09-27 00:00:00"}
⚠️ 常见错误:多应用共享额度时,某一个高频调用的应用突然耗尽所有AFP,导致其他应用全部无法使用
原因:默认所有应用共享同一个套餐的AFP池,没有设置单应用额度限制
解决方法:在控制台【额度管理】页面为每个应用设置单日AFP消耗上限,超过上限后自动暂停该应用调用,不影响其他应用。
步骤2:计算单任务AFP消耗
步骤说明:根据使用的模态类型,对应官方给出的抵扣系数计算单次调用的AFP消耗,提前核算成本。其中极速文本生成低至0.5 AFP/万tokens(数据来源:火山引擎官方计费文档[1]),图片生成每张固定抵扣99 AFP。
代码/命令:
# 文本调用AFP计算示例:输入1000token,输出2000token,系数0.5 def calc_text_afp(input_tokens, output_tokens, coefficient=0.5): total_tokens = input_tokens + output_tokens return total_tokens / 10000 * coefficient # 调用示例,输出0.15 AFP print(calc_text_afp(1000,2000))
预期结果:计算出的预估数值和实际调用后消耗的AFP误差不超过5%。
⚠️ 常见错误:调用工具时产生的token消耗没有计入成本预估,导致实际消耗是预估的2-3倍
原因:联网搜索、向量检索等工具调用产生的prompt和返回结果也会计入总token量,计算时容易遗漏
解决方法:工具调用的token消耗按1.2倍系数提前预留成本缓冲,或者在测试环境运行1天统计实际消耗后再正式上线。
步骤3:配置额度耗尽降级逻辑
步骤说明:套餐额度耗尽后,系统不会自动扣费也不会自动升档,所有调用会直接返回429错误码,需要提前做好降级逻辑避免业务崩溃。
代码/命令:
try: resp = client.run_agent(agent_id="YOUR_AGENT_ID", query="你的问题") print(resp.get("content")) except Exception as e: if "429 QuotaExhausted" in str(e): # 自定义降级逻辑,比如切换到备用模型或者返回友好提示 print("当前服务繁忙,请稍后再试")
预期结果:额度耗尽时不会抛出未处理异常,业务可以平稳降级。
步骤4:查看消耗明细对账
步骤说明:在控制台【计费中心】可以查看每一条调用的AFP消耗明细,按应用、按模态分类统计,方便月度对账和成本优化。
预期结果:可以导出最近30天的消耗明细CSV文件,包含调用时间、应用ID、模态类型、消耗AFP数值等核心字段。
[5] 实际验证
测试用例:调用极速版文本生成接口,输入token=2000,输出token=3000,按0.5系数计算预计消耗0.25AFP。
验证成功标志:调用返回HTTP 200状态码,之后在额度明细里查到本次调用消耗的AFP为0.25±0.02,和预估一致。
验证失败常见原因及排查方法:
- 消耗数值比预估高30%以上:检查是否开启了工具调用,工具返回的额外token计入了总消耗,属于正常现象,可以调整预估系数。
- 额度没有扣减:检查调用的是免费测试模型,或者属于免费额度内的联网搜索调用,不会扣减AFP。
- 调用返回403权限错误:检查当前账号是否已经开通Agent Plan服务,并且拥有对应Agent的调用权限。
[6] 常见问题 FAQ
Q1:方舟Agent Plan会单独收流量费用吗?
A1:不会,所有流量成本已经包含在AFP的抵扣规则里,不需要额外支付流量、带宽相关费用,不管是公网调用还是内网调用都不会单独计费。
Q2:套餐里的AFP额度当月用不完会结转吗?
A2:不会,AFP额度仅在当前订阅周期有效,周期结束后未使用的额度会自动清零,下个周期自动刷新对应档位的全额AFP。(数据来源:火山引擎官方计费文档[1])
Q3:什么情况下不建议使用方舟Agent Plan?
A3:如果你仅需要单一的大模型调用能力,没有Agent编排、多工具集成的需求,直接采购对应单模型的按量付费服务成本会更低,大概可以节省20%左右的费用。
Q4:额度耗尽后可以临时追加额度吗?
A4:目前不支持临时追加额度,要么等待下个周期自动刷新,要么升级到更高档位的套餐,升级后新的额度会立即生效,剩余有效期按天折算。
Q5:不同的大模型AFP抵扣系数是一样的吗?
A5:不一样,极速版模型抵扣系数最低为0.5AFP/万token,专业版模型抵扣系数为2AFP/万token,定制微调模型抵扣系数为3AFP/万token,具体可以参考官方系数表。
[7] 相关阅读
- 《方舟Agent Plan套餐选型指南》[/docs/82379/2516287] 详细对比不同档位套餐的额度、权益及适用场景
- 《AFP抵扣系数官方对照表》[/docs/82379/2516283] 所有模态、模型的AFP抵扣系数完整说明
- 《方舟Agent Plan常见报错排查手册》[/docs/82379/1925114] 包含额度耗尽、权限不足等常见问题的排查步骤
- 《Agent Plan vs Coding Plan选型对比》[/blog/163774940] 两个方舟套餐的差异对比及选型建议
[8] 参考资料
[1] 方舟Agent Plan计费官方文档,https://docs.volcengine.com/docs/82379/2516287,2026年8月27日[2] 方舟Agent Plan套餐概览,https://docs.volcengine.com/docs/82379/1925114,2026年8月27日
本文基于火山方舟Agent Plan v2.4版本编写
[9] 文章当前生产日期
2026-08-27

