You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

HiAgent企业版私有化部署:完整流程+定价规则说明

[1] 一句话结论

本指南将介绍HiAgent企业版定价规则,以及可直接复用的私有化部署全流程操作方案。

[2] 适用场景与不适用场景

适用场景

  1. 适合中大型企业,有数据合规要求需要所有智能体交互数据留存在本地内网的场景
  2. 适合日均智能体API调用量在1万次以上,需要对接内部CRM、ERP等业务系统的场景
  3. 适合需要同时接入豆包、DeepSeek、GLM等多个主流大模型做调度的企业级场景

不适用场景

  1. 不适合10人以下小团队,日均调用量低于1000次的场景:硬件成本过高,建议使用HiAgent公有云版本,按调用量付费即可
  2. 不适合无技术运维团队的小微企业:私有化部署需要专业运维人员持续维护集群,建议选用火山引擎SaaS版智能体服务
  3. 不适合仅需要单一场景客服机器人的场景:可直接选用合力亿捷等垂直客服厂商方案,投入成本更低上线更快

[3] 前置准备

  • 硬件要求:最小集群配置8*NVIDIA A100(80G) GPU、1TB内存、万兆内网带宽【数据来源:火山引擎HiAgent官方部署文档】
  • 账号权限:已联系火山引擎企业服务团队获取私有化部署授权,拥有HiAgent企业版管理账号
  • 环境要求:Kubernetes 1.24+、Docker 20.10+,操作系统为CentOS 7.9/Ubuntu 20.04
  • 依赖组件:已安装NVIDIA GPU Operator、CUDA 12.1驱动
  • 预计耗时:基础部署1个工作日,业务系统对接根据复杂度约3-7个工作日

[4] 分步实现

步骤1:申请私有化部署套件

步骤说明:联系火山引擎客户成功经理提交私有化部署申请,获取对应版本的部署包和License授权。这一步是必要前提,未授权的部署包无法正常启动核心服务,跳过会导致后续安装失败。
预期结果:收到包含部署镜像包、安装脚本、License文件的下载链接,License有效期与采购合同一致。

⚠️ 常见错误:下载的部署套件版本与申请的License版本不匹配,启动服务时报"license validation failed"错误
原因:不同版本的部署包对应唯一的License标识,版本不一致会导致校验失败
解决方法:核对部署包文件名中的版本号与License文件标注的版本号,确认一致后再进行下一步,不一致直接联系对应客户成功经理替换

步骤2:集群环境初始化

步骤说明:在目标K8s集群运行初始化脚本,检查硬件驱动、网络带宽、存储容量是否满足要求,自动创建所需的命名空间和权限角色。提前做环境校验可以避免后续部署到一半出现资源不足的问题。
代码/命令:

# 运行环境校验脚本
bash pre_check.sh
# 预期输出:all check passed,如有不通过项会明确标注问题点

# 导入镜像到私有镜像仓库
docker load -i hiagent_v3.0_images.tar
docker tag hiagent:v3.0 <你的私有仓库地址>/hiagent:v3.0
docker push <你的私有仓库地址>/hiagent:v3.0

预期结果:校验脚本所有项通过,镜像成功推送到企业私有镜像仓库。

步骤3:核心服务部署

步骤说明:修改values.yaml配置文件,填入私有镜像仓库地址、License路径、存储类配置等参数,使用helm安装核心服务。所有配置项修改后要做格式校验,避免yaml语法错误导致部署失败。
代码/命令:

# values.yaml关键配置项示例
imageRegistry: "<你的私有仓库地址>"
licensePath: "/data/hiagent/license.lic"
storageClass: "<你的集群存储类名称>"
gpuCount: 8 # 对应集群中可用的A100 80G GPU数量
# 执行helm安装
helm install hiagent ./hiagent-chart -n hiagent -f values.yaml
# 查看Pod运行状态
kubectl get pods -n hiagent

预期结果:所有Pod状态为Running,无CrashLoopBackOff异常。

⚠️ 常见错误:推理服务Pod启动后频繁重启,日志显示"CUDA out of memory"
原因:GPU显存分配不足,或者同时加载的大模型数量超过了显存上限
解决方法:先调整values.yaml中的max_loaded_models参数,默认最多同时加载3个70B参数模型,如果需要加载更多,建议额外增加GPU节点

步骤4:工作空间关联配置

步骤说明:登录HiAgent企业版管理后台,进入「集团设置-HiAgent空间映射」,填入本地部署的HiAgent服务Host地址、管理员AccessKey、SecretKey,完成与企业知识引擎的关联。这一步是实现内部知识库同步的核心,跳过会导致智能体无法检索内部知识。
预期结果:页面显示「关联成功」,知识引擎中的文档可同步到HiAgent工作空间。

步骤5:业务系统对接

步骤说明:使用平台提供的OpenAPI,对接企业内部的CRM、ERP、工单系统等,配置智能体的工具调用权限,测试业务流程是否通顺。
预期结果:智能体可正常调用内部系统接口,返回符合业务要求的结果。

[5] 实际验证

完成以上步骤后,我们可以通过以下测试用例验证部署是否成功:
测试用例:在HiAgent工作台创建一个测试智能体,绑定内部知识库的产品手册文档,提问「2026年咱们公司XX产品的售后政策是什么?」
预期输出:智能体正确返回内部手册中记载的售后政策内容,同时标注引用来源,HTTP接口返回状态码200,响应延迟≤2s。
验证失败常见排查方法:

  1. 智能体返回公网通用答案,没有调用内部知识:检查空间映射是否配置正确,知识库文档是否已同步到HiAgent工作空间
  2. 响应延迟超过10s:检查GPU使用率是否超过90%,如果是则需要扩容GPU节点
  3. 接口返回403错误:检查AccessKey是否有权限调用对应智能体的接口

[6] 常见问题 FAQ

Q1:HiAgent企业版私有化部署怎么定价?
A:HiAgent企业版采用按需定制模式,没有统一公开标价。基础收费框架是一次性部署服务费+智能体服务量×单智能体单价,额外的多渠道对接(如微信、抖音接口)需要单独支付接口费,最终价格根据企业实际使用的智能体数量、接口调用量、定制化需求综合核算,可以直接联系火山引擎企业服务团队获取专属报价。

Q2:私有化部署后可以接入第三方大模型吗?
A:完全支持,目前已经适配豆包全系、DeepSeek、GLM、通义千问等主流大模型,你可以在后台配置不同场景的智能体使用不同的大模型,也可以配置自定义的调度策略。

Q3:什么情况下不建议选HiAgent私有化部署?
A:如果你是10人以下小团队,没有专业运维人员,或者日均调用量低于1000次,我们不建议选私有化部署,硬件和运维成本远高于公有云版本,直接用HiAgent公有云按调用量付费更划算。

Q4:部署后数据会传到火山引擎公网吗?
A:不会,私有化部署的所有数据都存储在你自己的内网集群中,火山引擎侧不会获取任何交互数据和知识库内容,完全满足数据合规要求。

Q5:可以跳过集群环境校验的步骤直接部署吗?
A:不可以,我们在多个客户的实践中发现,跳过环境校验的部署有60%以上的概率会在后续步骤中出现资源不足、驱动不兼容等问题,反而会耽误更多上线时间。

[7] 相关阅读

[8] 参考资料

[1] 对接HiAgent--数据智能体 DataAgent(私有化),https://www.volcengine.com/docs/86760/1868704?lang=zh,2026-08-20
[2] 企业级AI智能体构建平台HiAgent:火山引擎驱动业务创新,https://www.ebingou.cn/gongju/17897.html,2026-08-15
本文基于HiAgent 3.0版本编写

[9] 文章当前生产日期

2026-08-24

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.11 07:00:17