如何用Python正则表达式筛选符合特定格式的日志行
正则表达式筛选指定格式日志行
直接用下面的正则表达式即可精准匹配符合格式的日志行:
^\[\d{2}\.\d{2}\.\d{4} \d{2}:\d{2}:\d{2}\] <\d{2}> Info\s+.+$
正则各部分说明:
^锚定行开头,确保整行从目标格式起始\[\d{2}\.\d{2}\.\d{4} \d{2}:\d{2}:\d{2}\]匹配日期时间段,比如[12.12.2022 22:26:25],转义方括号避免正则语法冲突,\d{n}匹配指定位数的数字<\d{2}>匹配两位数字的级别标记,比如<01>Info\s+匹配固定关键字Info及后续的任意多空格.+$匹配消息内容直到行尾,$锚定行结尾
匹配示例:
- 匹配成功的行:
[12.12.2022 22:26:25] <01> Info Unregistering TCP client channel [bstcp]
- 自动排除的行:
Starting new log
Process: [64 bit], PID: [5028], SessionId: [0]
内容的提问来源于stack exchange,提问作者Osama Kadhim
相关产品推荐
相关产品推荐

