Python正则提取ID遇空值匹配错误,如何修正表达式?
适配ID为空场景的正则修正方案
原正则ID\s?:\s?(.*)\r*\n的问题在于(.*)是贪婪匹配,且未明确限定仅匹配当前行内容。当ID:后直接换行时,会错误地将下一行内容识别为ID值。
给你两种靠谱的修正方式:
方式一:用非贪婪匹配限定行内范围
把正则改成这样:
ID\s?:\s?(.*?)\r?$
.*?:非贪婪模式,只抓取到当前行结束前的内容,不会跨行\r?$:兼容Windows和Unix的换行格式,精准匹配行尾
方式二:直接限定匹配非换行字符
用[^\r\n]*替代.*,明确只抓当前行里的内容:
ID\s?:\s?([^\r\n]*)
[^\r\n]*:匹配任意数量的非换行字符,天然不会跨行,逻辑更直观
测试效果
拿这个测试文本验证:
ID: Rule name: abc Severity: Medium
修正后的正则会正确提取ID:后的空内容,不会误把下一行的Rule name: abc当成ID。
内容的提问来源于stack exchange,提问作者Neil Walker
相关产品推荐
相关产品推荐

