Chrome浏览器搜索时不同Unicode字符被错误高亮的技术问询
Chrome搜索半角片假名ム时高亮全角片假名ム和平假名む的原因
这是Chrome页面查找功能的默认行为导致的:
- Chrome的查找功能默认开启了Unicode等价匹配,同时针对日语做了语言适配。
ム(U+FF91)是半角片假名,ム(U+30E0)是对应的全角片假名,む(U+3080)是对应的平假名,这三个字符在日语里属于同源的语义/发音字符。 - Unicode标准将这类字符归为兼容等价类,Chrome会自动识别这种等价关系,搜索时不严格区分它们的编码差异,把这些同源字符都标记为匹配结果——本质是为了方便日语用户,不用刻意区分全半角、平片假名就能找到目标内容。

内容的提问来源于stack exchange,提问作者Bhuvan
相关产品推荐
相关产品推荐

