Python正则如何提取以SAT-开头、到行尾或分号结束的所有匹配词
Python正则提取解决方案
直接使用以下正则模式配合re.findall()即可满足全部规则:r'\bSAT-[^;]*(?=;|$)'
正则各部分说明
\b:匹配单词边界,符合「SAT-开头的单词边界」的匹配前提SAT-:匹配固定前缀[^;]*:匹配除分号外的任意字符,自动排除匹配词末尾紧跟的分号(?=;|$):正向预查,仅匹配分号前或字符串结束前的位置,既不会把分号纳入结果,也能完整提取位于字符串末尾/单独存在的匹配词re.findall()本身会返回所有符合规则的匹配项列表,自动满足多匹配项单独提取的要求
测试用例示例
import re # 测试1:匹配项位于字符串末尾 test1 = "new_appointment_requested; general; SAT-newlead" print(re.findall(r'\bSAT-[^;]*(?=;|$)', test1)) # 输出:['SAT-newlead'] # 测试2:匹配项后紧跟分号、多匹配项 test2 = "SAT-first; normal_val; SAT-second_233; other_content" print(re.findall(r'\bSAT-[^;]*(?=;|$)', test2)) # 输出:['SAT-first', 'SAT-second_233'] # 测试3:匹配项为字符串唯一内容 test3 = "SAT-onlyOne" print(re.findall(r'\bSAT-[^;]*(?=;|$)', test3)) # 输出:['SAT-onlyOne']
内容的提问来源于stack exchange,提问作者codefame
相关产品推荐
相关产品推荐

