You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Elasticsearch高亮时如何获取目标词更多前置上下文信息?

如何在Elasticsearch高亮结果中包含目标词前的上下文

问题场景

使用Elasticsearch高亮功能时,需要获取目标词之前的更多上下文内容:

  • 原始文本:

First sentense. Second sentense. The sentense contain target. Forth sentense.

  • 当前搜索“target”返回的高亮片段:

The sentense contain target. Forth sentense.

  • 期望的高亮片段:

Second sentense. The sentense contain target. Forth sentense.

当前查询语句

GET chapter_document/_search
{
  "query": {
    "match_phrase": {
      "content": "target"
    }
  },
  "collapse": {
    "field": "bookId"
  },
  "sort": [
    {
      "bookId": {
        "order": "desc"
      }
    }
  ], 
  "search_after" : ["10000097"],
  "highlight" : {
    "fields" : {
      "content" : { 
        "pre_tags" : ["<hl>"],
        "post_tags" : ["</hl>"]
        
      }
    }
  }
}

已尝试操作

  • 增大fragment_size参数,但仅能扩展目标词之后的内容,无法获取前置上下文。

解决方案

通过修改高亮配置,使用unified高亮器并开启prefer_prev参数,配合合适的fragment_size即可实现需求:

修改后的查询语句

GET chapter_document/_search
{
  "query": {
    "match_phrase": {
      "content": "target"
    }
  },
  "collapse": {
    "field": "bookId"
  },
  "sort": [
    {
      "bookId": {
        "order": "desc"
      }
    }
  }, 
  "search_after" : ["10000097"],
  "highlight" : {
    "fields" : {
      "content" : { 
        "pre_tags" : ["<hl>"],
        "post_tags" : ["</hl>"],
        "type": "unified",
        "prefer_prev": true,
        "fragment_size": 200,
        "boundary_scanner": "sentence"
      }
    }
  }
}

参数说明

  • type: "unified":启用unified高亮器,支持更灵活的片段位置控制
  • prefer_prev: true:强制高亮片段优先包含目标词之前的内容,将目标词置于片段后半部分
  • fragment_size:设置高亮片段的总长度,需根据文本实际长度调整,确保能容纳前置上下文与目标内容
  • boundary_scanner: "sentence":以句子为边界分割片段,避免出现截断句子的情况

内容的提问来源于stack exchange,提问作者xingbin

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.10 06:48:38