正则表达式如何捕获多字段中首个冒号加空格后的完整字段值?
解决方案
问题出在原正则的贪婪匹配逻辑:([^\]]*)会匹配左括号后到最后一个: 之前的所有内容(只要不是右括号就持续匹配),导致字段名被错误包含了值里的部分内容。
修正后的正则表达式
\[([^:\]]+)\:\s+(.*?)]
正则说明
\[:匹配左方括号[([^:\]]+):捕获字段名,匹配不含冒号和右括号的任意字符(确保只停留在第一个冒号前,因为字段名本身不含冒号)\:\s+:匹配字段名后的分隔符(冒号+一个或多个空格,兼容多空格场景)(.*?):非贪婪捕获字段值,匹配从分隔符后到右括号前的所有内容(包括值内的冒号、空格等特殊字符)]:匹配右方括号]
测试验证
针对日志中Field3的片段[Field3: Name of Item: Using a colon in Name],该正则会正确捕获:
- 分组1(字段名):
Field3 - 分组2(字段值):
Name of Item: Using a colon in Name
完全符合期望结果。
内容的提问来源于stack exchange,提问作者yelkrab
相关产品推荐
相关产品推荐

