You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何拆分含转义分隔符的字符串?正则表达式优化需求

解决转义分隔符的正则匹配问题

要实现忽略被转义的|作为分隔符,提取你需要的内容,我们可以从分割未被转义的分隔符或者直接匹配目标内容两个方向入手,下面是具体的实现方案:

方案一:分割未被转义的|

核心思路是:只把未被反斜杠转义的|当作分隔符,而被\|转义的|保留为内容的一部分。

步骤说明

  1. 用正则匹配所有未被转义的|作为分割符;
  2. 过滤分割后产生的空字符串(因为原字符串以|开头);
  3. 将每个片段中的\|替换为普通的|,得到最终结果。

代码示例

const str = '|1|2|\\|Three and Four\\||5'; // 注意:字符串字面量中转义反斜杠需要写两个\\
// 匹配未被转义的|:前面没有反斜杠,或前面有偶数个反斜杠(即已转义的反斜杠)
const separatorRegex = /(?<!\\)(\\\\)*\|/;
// 分割并过滤空值
const rawParts = str.split(separatorRegex).filter(part => part !== '');
// 替换转义的|为普通|
const finalResult = rawParts.map(part => part.replace(/\\\|/g, '|'));

console.log(finalResult); // 输出:["1", "2", "|Three and Four|", "5"]

方案二:直接匹配目标内容

另一种思路是直接匹配所有不是未转义|的内容,也就是连续的「非|字符」或「被转义的\|」。

代码示例

const str = '|1|2|\\|Three and Four\\||5';
// 匹配连续的:要么是转义的\|,要么是非|字符
const contentRegex = /(?:\\\||[^|])+/g;
// 直接匹配得到原始片段
const rawParts = str.match(contentRegex);
// 替换转义的|为普通|
const finalResult = rawParts.map(part => part.replace(/\\\|/g, '|'));

console.log(finalResult); // 输出:["1", "2", "|Three and Four|", "5"]

正则解释

  • 分割正则/(?<!\\)(\\\\)*\|/:

    • (?<!\\):负向回溯断言,确保当前|的前面不是单个未转义的反斜杠;
    • (\\\\)*:匹配零个或多个连续的\\\\(即字符串中的\\,表示已转义的反斜杠,不会影响后面的|);
    • \|:匹配作为分隔符的|。
  • 匹配内容正则/(?:\\\||[^|])+/g:

    • (?:\\\||[^|]):非捕获组,匹配「转义的\|」或「任意非|字符」;
    • +:确保匹配连续的内容片段,而不是单个字符;
    • g:全局匹配所有符合条件的片段。

内容的提问来源于stack exchange,提问作者Hexodus

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.22 08:53:59