如何编写正则表达式忽略选中句子的前两个单词?
正则表达式实现忽略前两个单词提取剩余内容
核心思路
匹配字符串开头的两个单词及后续分隔空格,通过捕获组提取剩余内容,或直接替换掉前两个单词部分来得到目标文本。
正则方案及使用示例
方案1:捕获组提取目标内容
正则表达式:
^\S+\s+\S+\s+(.*)$
^:锚定字符串起始位置\S+:匹配第一个非空白字符序列(第一个单词)\s+:匹配一个或多个分隔空格\S+:匹配第二个非空白字符序列(第二个单词)\s+:匹配第二个单词后的分隔空格(.*):捕获剩余所有内容(作为第一个捕获组)
使用示例(Python):
import re input_text = "October 27 New Store Products / October 2022" match_result = re.match(r'^\S+\s+\S+\s+(.*)$', input_text) if match_result: target_content = match_result.group(1) print(target_content) # 输出:New Store Products / October 2022
方案2:替换前两个单词实现提取
直接将开头的两个单词及后续空格替换为空字符串,正则表达式:
^\S+\s+\S+\s+
使用示例(Python):
import re input_text = "October 27 New Store Products / October 2022" target_content = re.sub(r'^\S+\s+\S+\s+', '', input_text) print(target_content) # 输出:New Store Products / October 2022
适配场景调整
如果字符串开头可能存在空白字符,可修改正则为:
^\s*\S+\s+\S+\s+(.*)$
\s*用于匹配开头的零个或多个空白字符,避免因前置空格导致匹配失败。
内容的提问来源于stack exchange,提问作者Raziel Zohar
相关产品推荐
相关产品推荐

