You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何将CSV多列/字段拼接为单个字符串字段存入Azure索引

实现Azure Search中CSV文本字段的拼接索引

1. 更新索引,新增拼接结果字段

先给已有的Azure Search索引添加一个用于存储拼接文本的字段,比如命名为combinedText。如果需要让这个字段支持全文搜索,记得把searchable设为true。

示例(REST API方式修改索引)

{
  "name": "你的索引名称",
  "fields": [
    // 保留原有所有字段配置
    {
      "name": "combinedText",
      "type": "Edm.String",
      "searchable": true,
      "filterable": false,
      "sortable": false,
      "facetable": false
    }
  ]
}

也可以直接在Azure Portal中找到目标索引,进入“字段”页面添加该字段。

2. 修改索引器,添加字段拼接映射

在索引器的字段映射规则里,使用Azure Search内置的concat函数,把CSV里需要拼接的文本字段组合起来。

示例(REST API方式修改索引器)

假设你的CSV包含title、description、content三个文本字段,配置如下:

{
  "name": "你的索引器名称",
  "fieldMappings": [
    // 保留原有一对一映射规则
    {
      "sourceFieldName": null,
      "targetFieldName": "combinedText",
      "mappingFunction": {
        "name": "concat",
        "parameters": {
          "inputs": [
            { "sourceFieldName": "title", "separator": " " },
            { "sourceFieldName": "description", "separator": " " },
            { "sourceFieldName": "content" }
          ]
        }
      }
    }
  ]
}
  • separator是字段间的分隔符,可根据需求换成空格、换行符(\n)或其他自定义符号
  • 如果某个源字段为空,concat会自动忽略,不会生成多余的分隔符

如果用Azure Portal操作:找到目标索引器,进入“字段映射”页面,点击“添加映射”,选择“使用函数”,然后选concat,依次添加要拼接的源字段和分隔符,目标字段选刚才新增的combinedText即可。

3. 重新运行索引器

保存索引和索引器的配置后,手动触发索引器重新运行,新的拼接逻辑就会生效,所有CSV数据的文本字段会被拼接后写入combinedText字段。

注意事项

  • 确保要拼接的源字段都是CSV中存在的有效字段,且数据源能正确识别
  • 如果需要让拼接后的字段支持搜索,必须保证目标字段的searchable属性为true
  • 后续若CSV新增文本字段,只需更新concat函数的inputs参数,重新运行索引器即可

内容的提问来源于stack exchange,提问作者Vitor Alcântara Batista

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.25 15:52:14