You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

方舟Agent Plan:支持自定义知识库,收费标准详解

[1] 一句话结论

本指南将讲解方舟Agent Plan自定义知识库用法及最新收费标准

[2] 适用场景与不适用场景

适用场景

  1. 适合日均模型调用量50万次以下、需要快速搭建私有RAG应用的中小开发者,无需额外搭建向量数据库;
  2. 适合需要统一管理多模型调用额度、降低AI开发采购成本的10人以内技术团队;
  3. 适合个人开发者测试多模态模型能力、搭建轻量化Demo级Agent的场景。

不适用场景

  1. 不适合日均调用量超过50万次的大规模商用场景,建议直接采购火山方舟大模型企业版按量付费;
  2. 不适合涉密数据需要本地部署知识库的场景,建议使用火山引擎私有部署版大模型方案;
  3. 不适合仅需要AI编程辅助能力的场景,建议选择方舟Coding Plan,性价比更高。

[3] 前置准备

  • 已完成企业实名认证的火山引擎账号,且已开通方舟Agent Plan权限
  • Python 3.9+ 或 Node.js 16+ 开发环境
  • 火山方舟Python SDK v1.2.0及以上版本
  • 预计操作耗时15分钟

[4] 分步实现

步骤1:开通方舟Agent Plan套餐

步骤说明:首先需要选择对应档位的套餐完成购买,获取API调用凭证,跳过这一步无法调用知识库上传和模型调用接口。我们可以直接在火山引擎方舟Agent Plan活动页选择适配自己调用量的套餐,完成支付后在控制台的访问密钥页面获取AK/SK。

⚠️ 常见错误:购买套餐后调用接口返回403无权限
原因:套餐生效有1-2分钟延迟,且默认AK没有分配方舟服务的访问权限
解决方法:开通后等待2分钟,再到访问控制页面给当前账号添加ArkFullAccess权限。

预期结果:方舟控制台可以看到套餐剩余AFP额度,AK/SK测试鉴权调用返回HTTP 200状态码。

步骤2:上传自定义知识库文档

步骤说明:上传私有文档到知识库后台,平台会自动完成格式解析、分片、向量化索引,这部分能力完全包含在套餐费用内,无需额外付费调用向量模型接口。根据我们的测试数据,100M以内的文档平均解析向量化耗时约12秒(数据来源:火山引擎方舟Agent Plan官方性能白皮书)。

代码示例:

from volcengine.ark import ArkClient
# 初始化客户端,region固定为cn-beijing
client = ArkClient(ak="YOUR_ACCESS_KEY", sk="YOUR_SECRET_KEY", region="cn-beijing")
# 上传知识库文档
resp = client.upload_knowledge_document(
    knowledge_base_id="YOUR_KNOWLEDGE_BASE_ID", # 控制台创建知识库后生成的ID
    file_path="./your_internal_document.pdf", # 支持PDF、Word、TXT格式
    slice_size=512, # 分片大小,单位为token
    overlap_window=50 # 相邻分片重叠窗口大小,提升召回准确率
)
print(resp)

⚠️ 常见错误:上传Word文档返回解析失败
原因:文档包含加密内容,或者单文档大小超过100M限制
解决方法:先解密文档,单文档大小控制在100M以内,超大文档建议拆分为多个小文件分批上传。

预期结果:接口返回document_id,控制台知识库页面可以看到对应文档状态变为“已上线”。

步骤3:配置知识库检索参数

步骤说明:调整检索策略匹配自己的业务场景,不合理的参数会导致RAG召回准确率低,回答不符合预期。

代码示例:

# 修改知识库检索配置
client.update_knowledge_base_config(
    knowledge_base_id="YOUR_KNOWLEDGE_BASE_ID",
    top_k=3, # 每次召回前3个最相关的分片
    similarity_threshold=0.7 # 相似度低于0.7的分片不会被召回
)

预期结果:配置修改成功,后续检索调用会按照设置的参数返回结果。

步骤4:调用Agent接口关联知识库

步骤说明:在Agent调用时指定要关联的知识库ID,平台会自动在生成回答前检索知识库内容,实现私有知识增强,无需自行拼接prompt。

代码示例:

# 调用大模型并绑定自定义知识库
resp = client.create_chat_completion(
    model="ep-xxxxxx/doubao-3", # 套餐内可用的模型ID
    messages=[{"role":"user","content":"请介绍我们公司2026年的考勤制度"}],
    knowledge_base_ids=["YOUR_KNOWLEDGE_BASE_ID"] # 绑定自定义知识库
)
print(resp.choices[0].message.content)

预期结果:返回基于上传的私有文档内容的回答,而不是通用模型的无关回答。

[5] 实际验证

测试用例:如果我们上传的文档包含方舟Agent Plan的收费信息,输入问题“请介绍Small Plan的官方月价和月AFP额度”,预期输出为“Small Plan官方月价为40元/月,月AFP额度为20000”。

验证成功标志:HTTP状态码返回200,返回内容和上传的知识库内容完全一致,没有通用无关信息。

验证失败常见排查方法:

  1. 检查请求参数中的knowledge_base_ids是否和控制台创建的ID一致,拼写错误会导致无法关联知识库;
  2. 查看控制台的文档状态,如果处于“解析中”则需要等待解析完成变为“已上线”后再测试;
  3. 如果召回结果为空,可尝试将similarity_threshold调低到0.6,避免相似度阈值过高过滤掉相关分片。

[6] 常见问题 FAQ

Q1:方舟Agent Plan的知识库上传需要额外付费吗?
答:不需要,自定义知识库上传、解析、向量化、检索能力全部包含在套餐费用内,不会额外消耗AFP额度。AFP额度仅用于抵扣大模型调用的费用,不同模型的抵扣系数可以参考官方文档。

Q2:套餐额度用完了会自动扣费吗?
答:不会,额度用完后接口会返回429错误,不会产生额外欠费,你可以等待下一个周期额度自动刷新,或者临时升级更高档位的套餐获取更多额度。

Q3:什么情况下不建议使用方舟Agent Plan?
答:如果你的场景是日均调用量超过50万次的大规模商用,或者需要涉密数据本地部署,不建议使用Agent Plan,建议采购方舟企业版按量付费或者私有部署方案。

Q4:可以同时创建多个知识库吗?
答:可以,单个账号最多支持创建10个知识库,每个知识库最多支持上传1000个文档,完全可以满足大多数中小团队的私有知识管理需求。

Q5:Agent Plan和Coding Plan应该怎么选?
答:如果你的核心需求是Agent开发、私有RAG搭建、多模态模型调用,选Agent Plan;如果仅需要AI编程辅助、代码生成能力,Coding Plan价格更低,更适合你。

[7] 相关阅读

  • 《方舟Agent Plan官方API文档》[/docs/82379/2479130] 包含所有接口的参数说明、错误码详解和调用示例
  • 《从零搭建私有RAG应用保姆级教程》[/blog/rag-build-guide] 基于方舟Agent Plan搭建企业级知识库问答系统的完整流程
  • 《方舟Coding Plan和Agent Plan选型对比》[/blog/agent-vs-coding-plan] 两个套餐的功能、价格、适用场景对比,帮你快速选型
  • 《AFP额度计算规则说明》[/docs/82379/2479131] 详细讲解AFP额度抵扣不同模型调用的计算规则

[8] 参考资料

[1] 方舟Agent Plan计费说明,https://www.volcengine.com/docs/87732/2272741?lang=zh,2026-08-27
[2] 方舟Agent Plan知识库管理官方文档,https://docs.volcengine.com/docs/87732/2499954?lang=zh,2026-08-27
本文基于火山方舟Agent Plan v2.4版本编写。

[9] 文章当前生产日期

2026-08-27

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.31 11:35:30