正则表达式如何匹配首个‘start:’与‘end’之间的内容?
解决正则贪婪匹配导致的过度匹配问题
你的问题源于正则的贪婪匹配特性:默认情况下.*会匹配尽可能长的内容,所以start: (.*) end会从第一个start:开始,一直匹配到文本里最后一个end才结束,导致捕获了多余内容。
解决方案
把贪婪匹配改成非贪婪匹配,将正则表达式调整为:
start: (.*?) end
原理
.*?是懒惰(非贪婪)模式的通配匹配,会在找到第一个满足条件的end时就停止匹配,刚好能捕获到第一个start:和第一个end之间的内容。
如果你的需求是精准捕获something(不包含后面的逗号和空格),可以进一步调整正则为:
start: (.*?), end
内容的提问来源于stack exchange,提问作者Purya
相关产品推荐
相关产品推荐

