如何筛选特定格式的LineEntry日志行?正则匹配无结果求有效方案
解决方法
你的正则没起作用是因为匹配逻辑没贴合目标行的结构,原目标行格式是LineEntry: [地址范围): /路径:行号:列号,之前的正则生硬匹配5个非冒号段,会被前面的LineEntry:和地址部分的冒号打乱匹配逻辑。
方法一:用精准正则匹配
直接针对目标行结构写正则,比如:
import re # 匹配完整的符合要求的LineEntry行 matches = re.findall(r'LineEntry: \[0x[0-9a-fA-F]+-0x[0-9a-fA-F]+\): /[^:]+:\d+:\d+', data)
拆解正则各部分:
LineEntry::锁定行开头的固定前缀,避免匹配无关行\[0x[0-9a-fA-F]+-0x[0-9a-fA-F]+\):精准匹配十六进制格式的地址范围:/[^:]+:匹配从:/开始的路径部分,直到下一个冒号结束:\d+:\d+:匹配数字格式的行号和列号
如果地址部分格式可能有变动,也可以用更灵活的写法:
matches = re.findall(r'LineEntry: .+:/[^:]+:\d+:\d+', data)
这里的.+会匹配地址范围的任意内容,只要后面跟着:/路径:行号:列号的结构即可。
方法二:不用正则,直接遍历判断
如果对正则不熟,也可以通过分割字符串筛选:
filtered_lines = [] for line in data.splitlines(): if not line.startswith('LineEntry:'): continue # 按冒号分割行内容 parts = line.split(':') # 符合要求的行分割后至少有5个部分,且最后两个是数字(行号、列号) if len(parts) >= 5 and parts[-1].strip().isdigit() and parts[-2].strip().isdigit(): filtered_lines.append(line)
内容的提问来源于stack exchange,提问作者user3555115
相关产品推荐
相关产品推荐

