You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Azure Search索引器遇错误停止,需配置为遇错不终止Blob批量索引

解决Azure搜索索引器遇错误停止的问题

核心配置调整

要让索引器忽略错误继续执行,关键是调整索引器的容错设置,具体操作如下:

1. 开启错误容忍

在索引器配置中修改以下参数:

  • 将 failOnError 设为 false:关闭后索引器不会因单个文档的提取错误停止,会自动跳过错误文档继续处理其他数据。
  • 配置 maxFailedItems 和 maxFailedItemsPerBatch:可设为-1表示不限制失败文档数量,也可根据业务需求设置具体数值,达到阈值后才停止运行。

2. 针对性处理提取错误

针对报错Could not extract content or metadata from document,可以额外做以下配置:

  • 跳过不支持的文件类型:在Blob数据源配置里添加excludedFileNameExtensions参数,列出无法提取内容的文件后缀(比如.exe、.zip等二进制文件),避免索引器尝试处理这类文件。
  • 适配文件格式与大小:根据文件类型调整parsingMode(比如JSON文件设为json,CSV文件设为delimitedText);若因大文件报错,可设置maxContentLength限制提取的内容大小,避免超出处理上限。

3. 配置方式示例

  • Azure门户操作:进入Azure搜索服务,找到目标索引器,在「设置」标签页的「容错」区域,勾选「继续处理,即使有项目失败」,并设置允许的失败数量。
  • Azure CLI命令:
az search indexer update --name <索引器名称> --resource-group <资源组名称> --service-name <搜索服务名称> --set parameters.failOnError=false parameters.maxFailedItems=-1 parameters.maxFailedItemsPerBatch=-1

额外排查建议

  • 查看索引器执行历史:在门户的索引器详情页,查看失败文档的具体信息,定位是哪些文件类型或大小引发的错误,针对性优化。
  • 单个文档测试:将报错的文档单独用Azure搜索内容提取能力测试,确认是否是文件损坏或特殊格式导致的问题。

内容的提问来源于stack exchange,提问作者subbud

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.03 10:45:33