You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

C#正则分割问题:如何将右括号与空格拆分为独立令牌

解决C#正则拆分时括号与空格合并的问题

原来用\b拆分确实会遇到这个问题——因为右括号)和空格都属于非单词字符(\W),它们之间不存在单词边界\b,所以Regex.Split不会在这个位置拆分,导致) 被合并成一个元素。

要解决这个问题,我们需要在正则中额外添加针对括号的拆分规则,让括号和相邻的字符(不管是单词还是空格)都能被拆分开。这里有两种简洁的方案:

方案一:精准匹配所有需要拆分的位置

使用包含零宽断言的正则,明确匹配四种需要拆分的边界:

var c = "Sum(Table.Fieldname) As Alias";
string[] tokens = Regex.Split(c, @"(?<=\w)(?=\W)|(?<=\W)(?=\w)|(?<=[()])(?=[^()])|(?<=[^()])(?=[()])");

正则规则解释:

  • (?<=\w)(?=\W):匹配单词字符→非单词字符的边界(比如Sum后面的(,Table后面的.)
  • (?<=\W)(?=\w):匹配非单词字符→单词字符的边界(比如.后面的Fieldname,空格后面的As)
  • (?<=[()])(?=[^()]):匹配括号→非括号字符的边界(比如)后面的空格)
  • (?<=[^()])(?=[()]):匹配非括号字符→括号的边界(比如Sum后面的()

拆分后得到的令牌数组为:
["Sum", "(", "Table", ".", "Fieldname", ")", " ", "As", " ", "Alias"],完美实现了)和空格的独立拆分。

方案二:简化版正则(更易读)

如果觉得上面的正则太长,可以用更简洁的写法,直接针对括号添加拆分点:

var c = "Sum(Table.Fieldname) As Alias";
string[] tokens = Regex.Split(c, @"\b|(?<=[()])|(?=[()])");

正则规则解释:

  • \b:保留原来的单词边界拆分逻辑
  • (?<=[()]):匹配括号后面的位置(强制在)后拆分)
  • (?=[()]):匹配括号前面的位置(强制在(前拆分)

这个写法同样能得到和方案一完全一致的结果,而且更易理解和维护。

不管用哪种方案,都能完美处理你提到的两种格式:Sum(Table.Fieldname) As Alias和Table2.Fieldname2 As Alias,拆分后的令牌都符合预期。

内容的提问来源于stack exchange,提问作者user2728841

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.13 08:59:08