HiAgent知识库导入更新:无单独服务费 仅收Token与超量存储费
[1] 一句话结论
本指南将明确HiAgent知识库导入、更新操作的收费规则,帮你合理控制知识库运维成本。
[2] 适用场景与不适用场景
适用场景
- 企业用户批量导入1000篇以上内部文档,搭建智能客服知识库的场景;
- 每月需更新知识库内容5次以上,用于内部员工答疑智能体的场景;
- 需要开启知识库自动Schema生成、检索重排序的高准确率要求场景。
不适用场景
- 单篇文档小于100字、仅需临时存储的场景,建议直接使用火山引擎对象存储TOS,不需要走知识库向量化流程;
- 预算极低、完全不想为知识库操作产生任何费用的场景,建议使用开源本地向量数据库自行搭建;
- 知识库总容量超过10TB的超大规模存储场景,建议搭配TOS做分层存储,降低超量存储成本。
[3] 前置准备
- 已开通火山引擎HiAgent服务,拥有知识库编辑权限;
- 了解当前账号HiAgent套餐的免费Token额度、免费存储容量;
- 已安装火山引擎HiAgent Python SDK V1.2.0+;
- 预计耗时:10分钟即可完成收费规则核对和成本预估。
[4] 分步实现
步骤1:查询当前账号套餐额度
步骤说明:首先查询自己的套餐包含的免费向量模型Token额度、免费存储空间,提前计算待导入内容的消耗,避免超量产生意外账单,跳过这一步可能出现意料之外的扣费。
代码示例:
import volcenginesdkcore from volcenginesdkhiagent.models import DescribePackageRequest configuration = volcenginesdkcore.Configuration() configuration.ak = "YOUR_ACCESS_KEY" # 替换为你的AK configuration.sk = "YOUR_SECRET_KEY" # 替换为你的SK api_instance = volcenginesdkhiagent.HiAgentApi(volcenginesdkcore.ApiClient(configuration)) # 查询套餐额度 resp = api_instance.describe_package(DescribePackageRequest()) print(resp)
预期结果:返回包含免费额度的JSON,示例如下:
{ "free_vector_token": 1000000, "free_storage_gb": 10, "expire_time": "2026-12-31" }
⚠️ 常见错误:误以为所有导入操作都免费,直接批量导入10万篇文档后产生高额账单
原因:未提前核对免费额度,向量化消耗的Token超出免费额度后会自动按量计费
解决方法:导入前先计算待导入文档的总Token量,1000汉字约等于1300Token,若超出免费额度可分批次导入,或者提前购买向量模型资源包。
步骤2:配置知识库导入可选功能
步骤说明:导入时可以选择是否开启检索重排序、自动Schema生成等功能,这些功能会产生额外的模型Token消耗,非必要场景关闭可以节省30%以上的成本,默认开启状态下很容易产生非预期消耗。
代码示例:
from volcenginesdkhiagent.models import CreateKnowledgeBaseImportJobRequest req = CreateKnowledgeBaseImportJobRequest( knowledge_base_id = "YOUR_KNOWLEDGE_BASE_ID", # 替换为你的知识库ID file_urls = ["https://example.com/doc1.pdf"], # 替换为你的文档地址 enable_rerank = False, # 关闭重排序,节省重排序模型Token消耗 enable_auto_schema = False, # 关闭自动生成Schema功能 update_mode = "incremental" # 开启增量更新,仅处理修改部分内容 ) resp = api_instance.create_knowledge_base_import_job(req) print(resp)
预期结果:返回导入任务ID,状态为pending,示例如下:
{ "job_id": "kb-import-xxx", "status": "pending" }
⚠️ 常见错误:每次更新导入时都重新向量化整个文档,产生重复Token消耗
原因:未开启增量更新功能,默认全量更新会重复处理未修改的内容
解决方法:更新导入时传入update_mode="incremental",仅向量化新增或修改的内容,根据我们在某电商客户的实践统计,可节省70%以上的重复消耗。
步骤3:查看导入操作成本明细
步骤说明:导入完成后可以在费用中心查看本次导入产生的Token消耗和存储增量,确认成本符合预期,避免后续累计产生大额费用。
操作路径:登录火山引擎控制台→费用中心→账单明细→筛选产品为“HiAgent”。
预期结果:账单明细中仅能看到“向量模型Token消耗”“超量存储费”两个相关条目,不存在单独的“导入服务费”“更新服务费”条目。
[5] 实际验证
我们可以通过一个简单的测试用例验证收费规则:
测试用例:当前账号免费向量Token额度剩余100万以上、免费存储剩余5GB以上,导入1篇1000汉字的纯TXT文档,关闭所有可选功能。
输入:调用导入接口传入1000汉字的纯文本内容,开启增量更新。
预期输出:导入成功,本次操作Token消耗约1300,无扣费记录。
验证成功标志:HiAgent控制台知识库显示文档已正常导入,可正常检索,费用中心无新增HiAgent相关扣费记录。
验证失败排查:
- 如果产生了扣费:先检查是否开启了重排序、自动Schema等可选功能,再确认免费Token额度是否已耗尽;
- 如果Token消耗远高于预期:检查文档是否包含大量无用的页眉页脚、格式符号,导入前先清理冗余内容;
- 如果产生了存储费:检查当前知识库总容量是否已超出套餐免费存储额度。
[6] 常见问题 FAQ
Q1:HiAgent知识库导入更新会收取单独的服务费吗?
A:不会,没有单独的导入、更新操作服务费,仅会产生向量化的Token消耗,以及超出免费存储额度后的超量存储费。
Q2:我可以跳过向量化步骤直接导入文档来避免Token消耗吗?
A:不行,知识库的检索能力依赖向量化处理,跳过的话文档无法被检索到,不建议这么做。如果不需要检索功能,建议直接使用对象存储。
Q3:更新导入和首次导入的收费规则一样吗?
A:完全一样,都是按实际产生的Token量计费,如果开启增量更新,仅修改部分的Token会被计费。
Q4:什么情况下不建议使用HiAgent自带的知识库导入功能?
A:如果你的场景只需要存储文档,不需要AI检索能力,就不建议使用,建议直接用火山引擎对象存储TOS,存储成本仅为知识库超量存储费的1/10。
Q5:向量化用的是什么模型,Token单价是多少?
A:默认使用bge-large-zh向量模型,单价为0.002元/千Token,数据来源为火山引擎HiAgent官方计费文档。
[7] 相关阅读
- 《HiAgent知识库搭建全流程指南》[/docs/86681/1883791]:从零开始搭建企业级知识库的完整操作教程
- 《HiAgent计费规则官方说明》[/docs/86681/1883800]:完整的HiAgent所有功能的计费规则详解
- 《HiAgent增量更新功能使用教程》[/docs/86681/1883805]:教你如何使用增量更新降低知识库更新成本
[8] 参考资料
[1] 火山引擎HiAgent知识库概述,https://www.volcengine.com/docs/86681/1883790?lang=zh,2026-08-24
[2] 火山引擎HiAgent计费说明,https://www.volcengine.com/docs/86681/1883800?lang=zh,2026-08-24
本文基于火山引擎HiAgent V2.1.0版本编写。
[9] 文章当前生产日期
2026-08-24

