如何用正则表达式移除URL中http/https至.com的部分?
正则表达式移除指定URL片段解决方案
核心正则表达式
使用以下正则即可匹配并移除目标片段:
https?://[^.]+\.com
匹配逻辑
https?://:精准匹配http://或https://开头的协议部分[^.]+\.com:匹配到.com结尾的域名部分,[^.]+确保只匹配到域名的最后一段,避免误匹配包含.com的更长字符串
替换示例(以Python为例)
import re # 原字符串 original_text = 'The request is:<a href="https://stackoverflow.com/questions%22">https://stackoverflow.com/questions"</a>' # 正则模式 pattern = r'https?://[^.]+\.com' # 全局替换 processed_text = re.sub(pattern, '', original_text) print(processed_text)
运行输出:
The request is:<a href="/questions%22">/questions"</a>
注:你提供的示例结果简化了HTML标签部分,实际替换会保留原字符串中除匹配片段外的所有内容。
适用场景
该正则会全局匹配字符串中所有符合规则的片段,无论出现多少次都能一次性移除。
内容的提问来源于stack exchange,提问作者Y.B.L
相关产品推荐
相关产品推荐

