如何使SQL Server中CONTAINS查询达到Like 'Sam%'的匹配效果?
实现与
LIKE 'Sam%'等价的全文索引查询 先说明你遇到问题的核心原因:
- 使用
CONTAINS(FIRST_NAME, '"Sam*"')时,双引号代表精确短语前缀匹配,只会命中以"Sam"开头的完整单个词,所以"Sami""Samy"这类字符串会被匹配,但"Sam xx""Sam-Y"这类带空格、连字符的内容,会被分词器拆成多个独立词,因此不会被这个条件命中; - 使用
CONTAINS(FIRST_NAME, 'Sam')时,是匹配包含独立"Sam"词的行,所以"Sam xx""Sam-Y"会命中,但"Samxx""Sami"这类把Sam作为词前缀的字符串,因为Sam不是独立词,所以不会被命中。
要实现和LIKE 'Sam%'完全一致的查询结果,可按以下方式处理:
方法一:直接使用LIKE(简单直接)
如果表数据量不大,或者FIRST_NAME列有普通前缀索引,直接用LIKE就能满足需求:
SELECT PERSON_ID, FIRST_NAME FROM Person WHERE FIRST_NAME LIKE 'Sam%'
方法二:用全文索引实现前缀匹配(适合大数据量)
如果必须依赖全文索引的性能,可以使用不带双引号的前缀匹配语法,它会匹配所有包含以Sam开头的词的行,覆盖所有以Sam开头的字符串场景:
SELECT PERSON_ID, FIRST_NAME FROM Person WHERE CONTAINS(FIRST_NAME, 'Sam*')
这个写法会命中所有符合LIKE 'Sam%'的行,包括:
- 单个词以Sam开头:
Sam、Sami、Samxx、Sam123 - 以Sam作为第一个词的多词/带分隔符的字符串:
Sam xx、Sam-Y、Sam_xxx
默认分词规则下该写法已能覆盖绝大多数LIKE 'Sam%'的场景,若有特殊字符匹配需求,可调整全文索引的分词规则。
内容的提问来源于stack exchange,提问作者IlhamM
相关产品推荐
相关产品推荐

