如何在Elasticsearch中不新增字段将字符串字段转Double完成sum聚合
问题原因&解决方案
1. 报错直接原因
你的sum聚合语法不符合ES DSL规范:所有聚合操作必须嵌套在aggs(全称aggregations)根字段下,不能直接放在查询请求的根节点,这就是你收到Unknown key for a START_OBJECT in [sum]报错的原因。
2. 适配需求的实现方案
你要求保留原有string类型、不新增物理字段,不需要修改索引映射,有两种实现方式:
方式一:直接修正聚合脚本(兼容所有ES版本)
给sum聚合加外层aggs节点,同时给转double的逻辑加异常捕获,避免字段值不是合法数字时查询报错,正确查询语句如下:
GET /csv_metrics_index/_search { "query": { "bool": { "must": [ { "match": { "object_key": "example.csv" } }, { "match": { "event_path": "path/to/example.csv" } } ] } }, "aggs": { "stat_value_sum": { "sum": { "script": """ // 先判断字段存在且不为空 if (doc['stat_value'].size() == 0 || doc['stat_value'].value.empty) { return 0; } try { return Double.parseDouble(doc['stat_value'].value); } catch(Exception e) { // 非合法数字返回0,可根据需求调整为返回null return 0; } """ } } }, // 如果不需要返回原始文档可以加下面这行,提高查询效率 "size": 0 }
方式二:使用Runtime Fields(ES 7.11及以上版本推荐)
查询时动态定义运行时字段,将stat_value映射为double类型,该字段仅存在于本次查询上下文,不会修改索引原有映射、也不会写入任何物理存储,完全符合你的要求:
GET /csv_metrics_index/_search { "runtime_mappings": { "stat_value": { "type": "double", "script": """ if (doc['stat_value.keyword'].size() == 0) return; try { emit(Double.parseDouble(doc['stat_value.keyword'].value)); } catch(Exception e) {} """ } }, "query": { "bool": { "must": [ { "match": { "object_key": "example.csv" } }, { "match": { "event_path": "path/to/example.csv" } } ] } }, "aggs": { "stat_value_sum": { "sum": { "field": "stat_value" } } }, "size": 0 }
注意:如果你的stat_value字段是text类型,需要替换
doc['stat_value']为doc['stat_value.keyword']取原始字符串值,避免text分词后的结果导致转换失败。
内容的提问来源于stack exchange,提问作者anthony12345
相关产品推荐
相关产品推荐

