You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用正则表达式提取括号外的文本?

提取括号外文本的正则解决方案

核心思路

直接匹配并移除所有括号及括号内的内容,比尝试捕获括号外内容更直接高效,完美支持多组括号的场景。

基础正则模式(非嵌套括号)

用这个模式精准匹配任意一对括号及其内部内容:

\([^()]*\)

模式拆解:

  • \(:转义匹配左括号(括号是正则元字符,必须转义才能匹配字面量)
  • [^()]*:匹配任意数量的非括号字符,也就是括号内的所有内容(直到遇到右括号为止)
  • \):转义匹配右括号

Python 代码实现

借助re.sub()把匹配到的括号内容替换为空字符串,直接得到括号外的文本:

import re

input_str = "Hello (this is extra) world (more text)"
# 匹配括号及内部内容的正则
pattern = r"\([^()]*\)"
# 替换为空,保留括号外的文本
output_str = re.sub(pattern, "", input_str)
print(output_str)  # 输出: Hello  world

为什么[^()]+不好用?

[^()]+是匹配连续的非括号字符,用它提取会得到多个零散片段(比如["Hello ", " world"]),还要手动拼接;如果字符串开头/结尾是括号,还会出现空匹配的问题,远不如直接替换高效。

进阶:处理嵌套括号

如果遇到嵌套括号(比如Hello (this (is) extra) world),基础模式会失效(只会匹配到(this (is),这时候需要用支持递归的正则:

\((?:[^()]|(?R))*\)

模式拆解:

  • (?:[^()]|(?R))*:非捕获组,两种匹配逻辑二选一:
    1. [^()]:匹配非括号字符
    2. (?R):递归整个正则模式,处理嵌套的括号结构

对应的Python代码:

input_str_nested = "Hello (this (is) extra) world (more (nested) text)"
pattern_nested = r"\((?:[^()]|(?R))*\)"
output_str_nested = re.sub(pattern_nested, "", input_str_nested)
print(output_str_nested)  # 输出: Hello  world 

内容的提问来源于stack exchange,提问作者Kalyani Boyini

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.12 15:05:00