如何编写Elasticsearch查询实现技能数组完全匹配的候选人搜索
ES 精确匹配技能数组查询方案
前置要求
确保存储技能的skills字段为keyword类型,如果是默认的text + keyword复合字段,查询时使用skills.keyword代替skills即可。
实现逻辑
需求本质是要求skills数组和查询的技能列表完全相等(不多不少),满足两个条件即可:
- 候选人的
skills数组必须包含所有查询指定的技能 - 候选人的
skills数组长度必须和查询的技能数量完全一致
查询示例
方案1:动态计算数组长度(适合小数据量场景,无需修改写入逻辑)
示例1:查询仅包含Skill - 1的候选人
{ "query": { "bool": { "must": [ { "term": { "skills": "Skill - 1" } } ], "filter": [ { "script": { "script": "doc['skills'].size() == 1" } } ] } } }
示例2:查询仅包含Skill - 1和Skill - 2的候选人
{ "query": { "bool": { "must": [ { "term": { "skills": "Skill - 1" } }, { "term": { "skills": "Skill - 2" } } ], "filter": [ { "script": { "script": "doc['skills'].size() == 2" } } ] } } }
方案2:预存数组长度(适合大数据量场景,性能更高)
写入候选人数据时,新增一个整数类型的skill_count字段,直接存储skills数组的长度,查询时直接匹配该字段即可,避免实时计算的性能损耗:
{ "query": { "bool": { "must": [ { "term": { "skills": "Skill - 1" } }, { "term": { "skills": "Skill - 2" } }, { "term": { "skill_count": 2 } } ] } } }
注意事项
如果你的skills数组存在重复的技能值,需要在script逻辑中增加去重判断,示例:
"script": "doc['skills'].stream().distinct().count() == 2"
内容的提问来源于stack exchange,提问作者Yasin
相关产品推荐
相关产品推荐

