You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用正则表达式从字符串中捕获指定的多个分组?

正则表达式修正方案

原正则问题分析

你当前使用的([^.|_|data|gz]+)存在两处核心错误:

  • 方括号[]属于字符集匹配规则,仅对单个字符生效,你写入的|、data、gz都会被拆分为独立的单个字符做匹配,完全达不到排除特定字符串的效果
  • 仅定义了1个捕获分组,自然只能在单个分组下返回多轮匹配结果,无法直接得到4个独立的目标分组

修正后正则表达式

^([^.]+)\.([^_]+)_([^.]+)\.([^.]+)\.txt\.gz$

匹配逻辑说明

针对目标字符串John.7200_24.6.txt.gz的匹配规则如下:

  • ^锚定字符串起始位置
  • 第1个分组([^.]+):匹配第一个.之前的所有字符,捕获得到John
  • \.匹配第一个分隔符.
  • 第2个分组([^_]+):匹配_之前的所有字符,捕获得到7200
  • _匹配分隔符_
  • 第3个分组([^.]+):匹配下一个.之前的所有字符,捕获得到24
  • \.匹配第二个分隔符.
  • 第4个分组([^.]+):匹配第三个.之前的所有字符,捕获得到6
  • 末尾的\.txt\.gz$锚定固定后缀,确保仅匹配符合格式要求的字符串

通用适配版本

如果输入字符串后缀不固定为txt.gz,可以使用更通用的写法,只要前半部分的分隔规则不变即可正常捕获:

^([^.]+)\.([^_]+)_([^.]+)\.([^.]+)\..*

内容的提问来源于stack exchange,提问作者Finkelson

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.28 00:24:04