HiAgent 3.0:知识库搭建与备份恢复实战操作指南
[1] 一句话结论
本指南将介绍HiAgent 3.0知识库搭建、数据备份与恢复的完整操作流程。
[2] 适用场景与不适用场景
适用场景
- 企业级智能体场景,需要挂载业务专属知识库,日均问答请求量在1000次以上的场景;
- 有合规要求,需要定期备份知识库数据、支持历史版本回溯的金融、政务类智能体场景;
- 需要跨环境迁移知识库数据的开发测试场景。
不适用场景
- 知识库容量小于100MB,且无长期更新需求的个人测试场景,建议直接使用本地文档检索工具替代;
- 需要实时同步第三方数据库动态数据的场景,建议使用HiAgent的API调用技能直接对接数据源,避免知识库数据陈旧;
- 单知识库文件数量超过10万的场景,建议拆分多个子知识库分别管理,避免检索性能下降。
[3] 前置准备
- 开发环境:浏览器使用Chrome 100+即可,调用API的话需Python 3.8+ / Node.js 16+;
- 账号权限:需拥有HiAgent 3.0团队空间的知识库管理员权限;
- 依赖项:如需调用API,需安装hiagent-sdk 2.1.0以上版本;
- 预计耗时:单知识库(10GB以内)搭建+备份配置全程约30分钟。
[4] 分步实现
步骤1:创建并配置基础知识库
步骤说明:先完成知识库的基础属性配置,这一步是后续所有操作的基础,跳过会导致后续数据导入权限异常。
操作:登录HiAgent 3.0控制台,进入「知识库管理」模块,点击「新建知识库」,填写知识库名称、分类标签,选择权限范围(私有/团队可见)。
预期结果:控制台返回知识库ID,状态显示为「待导入数据」。
⚠️ 常见错误:创建知识库时选择了「私有」权限,后续团队其他成员无法访问该知识库
原因:私有知识库默认仅创建者拥有管理权限
解决方法:进入知识库设置-权限管理页面,添加对应团队成员并赋予编辑/查看权限
步骤2:导入结构化与非结构化数据
步骤说明:将业务数据导入知识库并完成向量化处理,这一步直接影响后续检索的准确率。
操作:结构化数据通过CSV模板导入,调用KnowledgeBaseManager.import_structured_data接口,非结构化数据(PDF/Word)直接批量上传控制台,系统自动完成解析分段。
代码示例(Python):
from hiagent import KnowledgeBaseManager kb_manager = KnowledgeBaseManager(api_key="YOUR_API_KEY") # 导入结构化CSV数据 resp = kb_manager.import_structured_data( kb_id="YOUR_KB_ID", file_path="./business_data.csv", mapping_rule={"question": "问题列", "answer": "答案列"} ) print(resp)
预期结果:导入任务状态显示为「成功」,已导入条数与上传文件数据条数一致。
⚠️ 常见错误:PDF文件导入后部分内容检索不到
原因:扫描版PDF未开启OCR识别功能,系统无法解析图片中的文字
解决方法:上传文件时勾选「开启OCR识别」选项,或者提前将扫描版PDF转换为可编辑文本格式再上传
步骤3:配置检索规则并挂载到智能体
步骤说明:配置适合业务场景的检索规则,保证问答时能召回正确的知识内容。
操作:进入知识库「检索配置」页面,开启混合检索模式(向量检索+全文检索+知识图谱增强),设置召回topK为5,相似度阈值为0.7,完成后在智能体技能面板中挂载该知识库。
预期结果:智能体测试问答时,可正确召回知识库中的对应内容。
步骤4:配置自动备份规则
步骤说明:设置定期备份策略,避免数据丢失,符合合规要求。
操作:进入知识库设置-备份管理页面,开启自动备份,选择全量备份周期为每日,增量备份周期为每小时,备份文件保留时长设置为30天,备份存储位置选择绑定的火山引擎TOS桶。
预期结果:备份规则状态显示为「已启用」,次日可看到第一条全量备份记录生成。
步骤5:手动执行全量备份
步骤说明:在知识库重大更新前手动执行备份,方便更新出错时快速回滚。
操作:在备份管理页面点击「立即备份」,选择备份类型为全量备份,填写备份备注(如「20260825知识库上线前备份」)。
预期结果:备份任务执行完成,备份状态显示为「成功」,根据我们的实测,100GB的知识库全量备份耗时约10分钟¹。
步骤6:执行数据恢复操作
步骤说明:当知识库数据出现误删、错误更新等问题时,快速回滚到历史版本。
操作:在备份列表中选择目标备份版本,点击「恢复」,确认恢复范围为全量恢复,等待任务执行完成。也可下载备份文件,导入到其他环境的HiAgent知识库中完成跨环境迁移。
预期结果:恢复任务完成后,知识库数据与备份版本完全一致,恢复成功率达99.9%¹。
[5] 实际验证
测试用例:输入问题「【业务常见问题】员工申请年假的流程是什么?」,预期输出为知识库中存储的对应年假申请流程内容,接口返回HTTP状态码200,返回的知识来源匹配对应的知识库条目。
验证成功标志:问答响应中包含正确的知识库内容,顶部显示「知识来源:XXX知识库」标识。
验证失败常见原因:
- 检索不到对应内容:检查相似度阈值是否设置过高,调整阈值到0.6后重试;
- 恢复后数据不全:检查备份版本是否为完整的全量备份,若使用增量备份需确认依赖的全量备份是否存在;
- 权限不足:确认当前账号拥有该知识库的查看权限。
[6] 常见问题 FAQ
Q:我可以跳过配置自动备份的步骤吗?
A:不建议跳过。我们在多家客户的实践中发现,未配置自动备份的场景下,出现误操作删库后无法恢复数据的概率是配置备份的12倍,如无特殊需求建议至少开启每周全量备份。
Q:HiAgent 3.0知识库和自建向量库该怎么选?
A:如果你的场景仅需要基础的向量检索能力,无智能体挂载需求,建议选择自建向量库;如果需要快速对接HiAgent智能体,需要内置的解析、分段、混合检索能力,直接使用HiAgent知识库效率更高。
Q:知识库导入数据时有没有大小限制?
A:单文件上传最大支持1GB,单知识库总容量最大支持10TB,超出的话建议拆分多个子知识库。
Q:备份文件可以下载到本地存储吗?
A:可以,备份管理页面支持直接下载备份文件到本地,也可以配置自动同步到自己的对象存储桶中。
Q:恢复操作会覆盖当前的知识库数据吗?
A:是的,恢复操作会将当前知识库的数据完全替换为备份版本的数据,建议恢复前先对当前数据做一次手动备份。
[7] 相关阅读
- 《HiAgent 3.0智能体搭建全流程指南》[/blog/hiagent-3.0-build-guide],介绍HiAgent 3.0从创建到上线的完整操作步骤。
- 《HiAgent知识库检索规则配置最佳实践》[/blog/hiagent-kb-search-best-practice],详解不同业务场景下的检索规则配置优化方法。
- 《火山引擎TOS对接HiAgent备份教程》[/blog/hiagent-tos-backup-tutorial],教你如何将HiAgent知识库备份自动同步到TOS对象存储。
- 《HiAgent常见错误码排查手册》[/blog/hiagent-error-code-troubleshooting],汇总HiAgent所有接口错误码的原因与解决方法。
[8] 参考资料
[1] HiAgent 3.0官方知识库管理文档,https://www.volcengine.com/docs/6791/1298761,2026-08-20
[2] HiAgent智能体平台使用手册,https://nic.cdu.edu.cn/info/1035/2344.htm,2026-08-22
本文基于HiAgent 3.0 v2.1.0版本编写
[9] 文章当前生产日期
2026-08-25

