OpenSearch中替代asciifolding移除希腊语重音的方案咨询
OpenSearch 希腊语重音/变音符号处理问题
我发现OpenSearch的asciifolding过滤器仅处理拉丁语重音,完全不支持希腊语(注:部分重音因字体问题显示效果不佳)。
测试请求
POST /_analyze { "text": [ "Latin: ấ ê ŏ õ ô ì / Greek: ἆ ᾧ ῦ ἄ ἒ " ], "filter": [ "asciifolding" ] }
测试响应
{ "tokens": [ { "token": "Latin: a e o o o i / Greek: ἆ ᾧ ῦ ἄ ἒ ", "start_offset": 0, "end_offset": 38, "type": "word", "position": 0 } ] }
请问是否存在其他可处理Unicode字符的内置过滤器,能够处理希腊语并移除重音/变音符号?还是必须自行开发?
我已找到两种替代实现思路,但希望有此类基础功能的内置方案:
- 从asciifolding转换规则中排除特定字符后自定义处理逻辑
- 修改asciifolding过滤器的转换规则实现功能扩展
欢迎提供相关提示或思路。
内容的提问来源于stack exchange,提问作者user2173353
相关产品推荐
相关产品推荐

