如何修改正则表达式,仅匹配第二个/ep/后的10个字符?
正则修改方案
需求回顾
目标字符串:www.mysite.de/ep/3423141549/ep/B104RHWZZZ?something
需要匹配第二个/ep/之后的10个字符,即结果为B104RHWZZZ
原正则问题分析
原正则(?<=/ep/)(?:(?!/ep/).)*$的问题在于:
- 它会匹配第一个
/ep/之后所有不包含/ep/的内容直到结尾,因此会包含后续的?something - 无法精准定位到第二个
/ep/之后的内容
修改后的正则方案
以下两种方案都可以实现需求:
方案1:精准定位第二个/ep/后直接匹配10字符
(?<=/ep/[^/]+/ep/).{10}
- 解释:
(?<=/ep/[^/]+/ep/):正向断言,确保前面是/ep/+ 任意非斜杠字符(即第一个/ep/后的ID部分) +/ep/.{10}:匹配接下来的10个字符,正好是目标内容B104RHWZZZ
方案2:通过重复匹配/ep/结构捕获目标
(?:.*?/ep/){2}(.{10})
- 解释:
(?:.*?/ep/){2}:非捕获组,匹配两次/ep/及其前面的任意内容(跳过第一个/ep/段)(.{10}):捕获组,匹配并提取第二个/ep/后的10个字符,取捕获组1的结果即可
验证结果
用上述正则匹配目标字符串,均可得到预期结果:B104RHWZZZ
内容的提问来源于stack exchange,提问作者Jannik
相关产品推荐
相关产品推荐

