You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用正则表达式(Regex)匹配连续重复字符序列并捕获重复数字组

连续重复数字分组的正则优化方案

核心优化思路

你当前的写法存在两个明显缺陷:一是需要逐个枚举1-9的数字分支十分冗长,二是遗漏了数字0的匹配场景,性能也较差。最优方案是利用正则反向引用特性实现,通用写法为:
(\d)\1*

语法解释

  • \d:匹配任意0-9的阿拉伯数字,自动覆盖所有数字场景
  • (\d):将第一个匹配到的数字存入捕获组1
  • \1:反向引用捕获组1的内容,代表和第一个数字完全相同的字符
  • 量词说明:
    • 用*:匹配包含单个数字在内的所有连续相同数字段
    • 用+:仅匹配至少连续出现2次的相同数字段,可自动过滤单独出现的数字

示例实现(Python)

import re

test_str = "1115555666777"
# 匹配所有连续相同数字段
match_groups = [item.group() for item in re.finditer(r"(\d)\1*", test_str)]
# 转换为你需要的带括号输出格式
result = "".join(f"({group})" for group in match_groups)

print(result)
# 输出:(111)(5555)(666)(777)

方案优势

  • 通用性强,该写法在所有支持反向引用的正则引擎中都可正常使用,覆盖Python、JavaScript、Java、Go等绝大多数主流开发语言
  • 写法简洁,无需枚举所有数字,维护成本极低
  • 覆盖0-9全数字匹配,不会出现遗漏
  • 正则匹配效率远高于多分支枚举的写法,长文本场景下性能优势更明显

内容的提问来源于stack exchange,提问作者sankiago

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.24 09:36:04