如何优化Perl正则表达式避免贪婪匹配(或在\Q\E中用否定)
解决方案
问题根源
你的正则错误地将标签后的内容(>#greeting</syntax)也纳入了$2的匹配范围,因为原正则逻辑是匹配从syntax标签开始到</syntax>结束之间的任意内容,而非仅捕获标签内部的属性部分。
修正后的正则表达式
调整匹配逻辑,精准捕获<syntax>标签内的属性(即<syntax与>之间的内容),跳过标签内文本后再匹配闭合标签及结尾单词:
$line =~ /(\w+)\Q$syntax{'start'}\E\Q$syntax{'syntax'}\E\s+([^>]+)\Q>\E.*?\Q$syntax{'end'}\E(\w+)/i
关键调整说明
([^>]+):仅匹配<syntax之后到>之前的所有内容,确保只捕获标签属性(如interpolate='#'),不会包含后续文本或闭合标签。\Q>\E.*?\Q$syntax{'end'}\E:匹配标签闭合符号>,再用非贪婪模式.*?跳过标签内的任意文本(如#greeting),直到遇到闭合标签</syntax>。- 保留开头
(\w+)和结尾(\w+),分别捕获BS和AS。
测试结果
代入目标字符串后,捕获结果符合预期:
$1 = BS$2 = interpolate='#'$3 = AS
内容的提问来源于stack exchange,提问作者Maelstrom
相关产品推荐
相关产品推荐

