如何使用正则表达式匹配连续两行中第二行为第一行加s结尾的内容
实现方案
这个需求可以通过正则的反向引用特性实现,你之前写法的问题是两次\w+匹配规则互相独立,没有做内容关联,同时没有锚定行边界,所以会命中大量无关内容。
正确正则写法
在PCRE/JavaScript/Java等主流正则引擎下,开启多行匹配(m修饰符)即可使用:
/^(\w+)\r?\n\1s$/m
如果是grep等命令行工具使用,对应写法为:
grep -Pzo '^(\w+)\n\1s$' words.txt
规则说明
^:匹配行首,确保捕获的是整行开头的内容(\w+):捕获第一行的完整单词,存储到分组1中\r?\n:兼容Windows(\r\n)和Unix(\n)两种换行格式\1:反向引用分组1捕获的内容,要求第二行开头必须和第一行的单词完全一致s:匹配单词末尾追加的s$:匹配行尾,确保第二行没有多余内容m修饰符:让^和$匹配每一行的首尾,而非整个文本的首尾
匹配效果
针对你提供的words.txt内容,该正则会精准匹配以下两行:
accountant accountants
不会命中你提到的action/actionables、actionable/actions等无关内容。
内容的提问来源于stack exchange,提问作者Julian A Avar C
相关产品推荐
相关产品推荐

