如何在Vespa Schema中配置自定义逻辑自动生成计算字段
Vespa Schema 实现品牌名称自动分词与符号清理
可以直接在Vespa Schema中定义计算逻辑,让系统自动生成brand_name_tokens字段,无需在写入前手动处理。
修改后的完整Schema
schema product { document product { field brand_name type string { indexing: summary | index } field brand_name_tokens type array<string> { computed-from: brand_name expression: split(replace(brand_name, r"[™®]", ""), " ") indexing: summary | index } } }
逻辑说明
computed-from: brand_name:指定该字段从brand_name字段计算得到expression部分分两步处理:replace(brand_name, r"[™®]", ""):移除brand_name中的™和®符号split(..., " "):将处理后的字符串按空格分割为字符串数组
indexing: summary | index:根据需求配置该字段的索引和摘要存储,可按需调整
这样配置后,Vespa会在文档写入或更新时自动计算brand_name_tokens的值,完全符合你要求的规则。
内容的提问来源于stack exchange,提问作者agent47
相关产品推荐
相关产品推荐

