HiAgent 3.0会话质检:自定义敏感词规则配置实操指南
[1] 一句话结论
本指南将教你配置HiAgent 3.0自定义敏感词检测规则。
[2] 适用场景与不适用场景
适用场景
- 适合日均会话量1万条以上、需要自定义业务敏感词拦截的在线客服场景
- 适合需要按业务线划分不同敏感词检测规则的多部门企业管理场景
- 适合有强合规要求需要留存敏感词拦截日志的金融、教育、电商行业场景
不适用场景
- 如果仅需通用色情、暴力、涉政等违规内容检测,不需要自定义业务规则,建议直接使用HiAgent基础版内置敏感词库即可
- 如果会话内容为非中文(如小语种)场景,建议搭配火山引擎内容安全多语种检测服务使用
- 如果单条规则敏感词量级超过10万条,建议参考【需补充:大数据级敏感词检索方案】替代
[3] 前置准备
- 已开通火山引擎HiAgent 3.0高级版权限,且开启AgentSentry安全防护服务
- 浏览器兼容Chrome 100+ / Edge 100+,无需额外开发环境
- 提前整理好需要配置的自定义敏感词列表/正则规则/业务样本文件
- 预计配置耗时15-30分钟
[4] 分步实现
步骤1:进入敏感信息防护配置页
步骤说明:这是所有规则配置的入口,跳过该步骤无法访问自定义规则配置界面。
操作:登录火山引擎ArkClaw企业版控制台,左侧菜单栏依次点击「安全管理」-「敏感信息防护」,点击页面右上角「添加规则」按钮。
预期结果:成功进入自定义规则配置表单页,无权限报错。
步骤2:配置规则基础参数
步骤说明:填写规则的基础标识信息,便于后续多规则管理和迭代,命名不规范会导致后续规则调整时无法快速定位对应业务线。
操作:1. 填写规则名称,建议采用「业务线-防护场景-生效时间」格式,如「电商客服-售后违禁词-202608」;2. 补充规则描述,标注规则覆盖的敏感词范围和适用助手;3. 检测类型选择「自定义敏感信息检测」。
预期结果:基础参数填写完成,无表单校验报错。
⚠️ 常见错误:规则名称使用中文特殊字符、长度超过32字符导致提交失败
原因:系统对规则名称的字符集和长度做了限制,仅支持中英文字符、数字、下划线、短横线,最大长度32位
解决方法:修改规则名称为符合要求的格式,删除特殊字符并控制长度在32位以内
步骤3:选择检测方式并配置敏感词规则
步骤说明:根据敏感词的格式类型选择对应的配置方式,选错检测方式会导致检测准确率下降50%以上(数据来源:火山引擎HiAgent 2026年Q2内部性能测试报告)。
操作:如果是固定格式的敏感内容(如内部工号、订单号、违禁关键词),选择「正则表达式」模式,输入对应的正则规则;如果是非固定格式的业务敏感资料(如内部保密话术、未公开的产品价格),选择「样本训练」模式,上传不少于100条的业务样本文件,系统自动生成检测特征。
正则示例:^[A-Z]{2}\d{8}$ (匹配两位大写字母加8位数字的内部订单号,需替换为你的业务规则)
预期结果:正则校验通过/样本上传完成,系统提示规则特征生成成功。
步骤4:设置规则执行策略
步骤说明:配置规则的生效范围和处置动作,这一步决定了规则触发后的实际效果,配置错误会导致规则不生效或者误拦截正常会话。
操作:1. 选择处置动作:「拦截」(直接阻断违规内容发送)或「提醒」(仅记录日志并给质检人员发送告警);2. 勾选该规则需要生效的助手范围,支持按业务线、助手组批量选择。
预期结果:执行策略选择完成,生效助手列表显示正确。
⚠️ 常见错误:未勾选任何生效助手导致规则发布后不触发检测
原因:规则默认不关联任何助手,必须手动选择生效范围才能正常运行
解决方法:返回执行策略配置页,勾选需要应用该规则的助手后重新发布
步骤5:测试规则效果
步骤说明:正式发布前必须测试,避免规则上线后出现大量误拦截或者漏检的情况。
操作:在页面内置的测试工具中,输入包含目标敏感词的测试文本和正常文本各5条以上,点击「测试」按钮查看检测结果。
预期结果:所有包含敏感词的测试用例均被识别,正常文本无误报。
步骤6:发布规则
步骤说明:测试通过后发布规则,规则会在1分钟内生效到所有选中的助手。
操作:确认所有配置无误后,点击页面底部「发布」按钮。
预期结果:页面提示「规则发布成功」,规则列表中该规则状态显示为「已生效」。
[5] 实际验证
测试用例:假设你配置的规则是拦截格式为两位大写字母加8位数字的内部订单号,输入测试文本「我的内部订单号是AB12345678」,点击测试。
验证成功标志:1. 系统识别到敏感内容,触发你配置的处置动作(拦截则显示拦截提示,提醒则显示命中告警);2. 会话质检日志中可以查到该条敏感命中记录,关联的规则ID与你刚配置的规则ID一致。
验证失败常见排查方法:1. 规则完全不触发:排查规则状态是否为「已生效」,是否勾选了对应的测试助手;2. 漏检:排查测试文本是否符合正则规则,样本训练模式则检查样本量是否不足,可补充10-20条对应样本重新训练;3. 误报:调整正则规则的匹配阈值,或者在规则中添加白名单关键词过滤正常内容。
[6] 常见问题 FAQ
Q1:自定义敏感词规则最多支持配置多少条?
A1:单个HiAgent实例最多支持配置200条自定义敏感词规则,单条规则最多支持1万条关键词配置,如果超过该量级建议联系商务升级实例配额。
Q2:规则发布后可以修改吗?
A2:可以修改,修改后需要重新测试再发布,旧版本规则会自动失效,历史命中日志会保留6个月可查询。
Q3:什么情况下不建议使用自定义敏感词规则?
A3:如果你的场景只需要检测通用的色情、暴力、涉政等违规内容,不建议配置自定义敏感词规则,直接使用HiAgent内置的通用内容安全检测即可,成本更低且准确率更高。
Q4:自定义敏感词规则的检测延迟是多少?
A4:单条规则的检测延迟≤20ms(数据来源:火山引擎HiAgent官方性能文档),对会话体验几乎无影响,即使叠加5条自定义规则总延迟也不会超过100ms。
Q5:我可以跳过测试步骤直接发布规则吗?
A5:不建议跳过,我们在多个电商客户的实践中发现,未经过测试的规则上线后误报率最高可达30%,会严重影响正常客服会话效率。
Q6:自定义敏感词规则和内置检测规则的优先级是怎样的?
A6:自定义规则优先级高于内置规则,如果两条规则同时命中,会优先触发自定义规则的处置动作,命中记录会同时上报到两条规则的日志中。
[7] 相关阅读
- 《HiAgent 3.0会话质检功能入门指南》[/docs/hiagent/3.0/quality-inspection-intro],了解会话质检的全功能框架和基础配置方法
- 《AgentSentry安全防护服务使用手册》[/docs/agentsentry/user-guide],详解HiAgent的全链路安全防护能力
- 《敏感信息防护规则最佳实践》[/blog/hiagent-sensitive-rule-best-practice],分享金融、电商、教育行业的敏感词规则配置案例
- 《会话质检日志查询与分析教程》[/docs/hiagent/3.0/log-analysis],教你如何查看和分析敏感词命中日志,输出合规报表
[8] 参考资料
[1] 火山引擎HiAgent官方文档:添加敏感信息防护策略,https://docs.volcengine.com/docs/87732/2479874?lang=zh,2026-08-24
[2] 火山引擎HiAgent 2026年Q2性能测试报告,https://www.volcengine.com/docs/hiagent/performance-report-2026q2,2026-08-20
本文基于HiAgent 3.0 2026年8月稳定版编写
[9] 文章当前生产日期
2026-08-24

