You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何将Azure中的indexStorageMetadataOnlyForOversizedDocuments设为true?

解决Azure导入容器数据时大PDF文件导致任务失败的设置方法

这个indexStorageMetadataOnlyForOversizedDocuments是Azure认知搜索索引器的配置参数,用来处理超过大小阈值的文档,以下是几种设置方式:

Azure 门户操作

  • 登录Azure门户,找到你的Azure认知搜索服务
  • 左侧菜单选择「索引器」,定位到你用于导入容器数据的目标索引器
  • 点击索引器进入详情页,选择「编辑」按钮
  • 在编辑界面中,找到「高级选项」板块(部分界面可能需要切换到「JSON编辑器」模式)
    • 如果用可视化界面:勾选「仅为超大文档索引存储元数据」选项
    • 如果用JSON编辑器:在parameters.configuration节点下添加或修改配置:
      "parameters": {
        "configuration": {
          "indexStorageMetadataOnlyForOversizedDocuments": true
        }
      }
      
  • 保存配置后,重新运行索引器任务即可

Azure CLI 命令

使用az search indexer update命令直接更新索引器配置:

az search indexer update --name <你的索引器名称> --service-name <你的搜索服务名称> --parameters '{"configuration": {"indexStorageMetadataOnlyForOversizedDocuments": true}}'

替换命令中的<你的索引器名称>和<你的搜索服务名称>为实际值,执行前确保已安装并登录Azure CLI。

REST API 调用

发送PUT请求更新索引器配置:

PUT https://<你的搜索服务名称>.search.windows.net/indexers/<你的索引器名称>?api-version=2023-11-01
Content-Type: application/json
api-key: <你的管理员密钥>

{
  // 保留索引器原有其他配置,仅添加或更新parameters部分
  "parameters": {
    "configuration": {
      "indexStorageMetadataOnlyForOversizedDocuments": true
    }
  }
}

注意:请求体需要包含索引器的完整配置(除了修改的参数,其他原有配置需保留),避免覆盖其他设置。

补充说明:默认情况下,Azure认知搜索索引器处理文档的大小阈值为16MB,当PDF等文档超过该阈值时,会触发任务失败,开启这个参数后,超大文档只会被索引元数据(如文件名、存储路径、文件大小等),不会尝试提取文档内容,从而避免任务失败。

内容的提问来源于stack exchange,提问作者David72

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.10 17:38:13