如何使用正则匹配/v/后不包含斜杠的aparat平台链接
正则匹配实现方案
核心匹配逻辑
需要保证URL在/v/路径段之后,直到整个URL结束,都不出现斜杠字符,同时避免截断匹配长URL的前缀部分。
不同场景正则写法
1. 整串完全匹配(待校验内容本身就是完整URL)
使用正则:
^https://www\.aparat\.com/v/[^/]+$
规则说明:
^匹配字符串开头,避免URL前缀存在多余字符https://www\.aparat\.com/v/匹配固定的域名与前缀路径,.用\转义避免被当作正则通配符;如果需要兼容http协议,可将https替换为https?,?代表前面的s字符可选[^/]+匹配1个及以上的非斜杠字符,保证/v/之后不会出现斜杠$匹配字符串结尾,避免截断匹配/v/xxx/yyy这类长URL的前缀部分
2. 从大段文本中提取符合要求的URL
如果需要从混杂了普通文本、多个URL的内容中筛选符合要求的链接,使用带边界校验的正则:
(?<=\s|^)https://www\.aparat\.com/v/[^/]+(?=\s|$)
规则说明:
- 开头
(?<=\s|^)、结尾(?=\s|$)为零宽断言,限定匹配的URL前后只能是空白字符或者文本首尾,不会误匹配长URL的前缀片段
验证效果
- 匹配成功:
https://www.aparat.com/v/xxx - 匹配失败:
https://www.aparat.com/v/xxx/yyy(/v/后存在额外路径段)https://www.aparat.com/v/xxx/(/v/后存在尾斜杠)- 其他协议、域名不符合的URL
内容的提问来源于stack exchange,提问作者msol98
相关产品推荐
相关产品推荐

