如何用re.finditer匹配多文件模式,每个匹配文件仅触发一次操作?
解决单文件匹配模式后仅执行一次操作的问题
当然可行,核心逻辑调整为:只要检测到目标文件中存在至少一个匹配项,就执行一次操作(打印/发邮件),立即终止对该文件的后续扫描,避免重复触发。
修改后的代码示例
import re import itertools cc_files = ["file1", "file2"] patlist = ["pat1", "pat2"] prglist = ["prg1", "prg2"] for pattern, prefix in itertools.zip_longest(patlist, prglist): for cc_file in cc_files: file_matched = False with open(cc_file) as f: # 用with语句自动管理文件句柄,更安全 for line in f: if re.search(pattern, line): # 找到第一个匹配就停止扫描当前行 file_matched = True break # 跳出行循环,不再检查当前文件的剩余内容 if file_matched: print(f'{pattern} in {cc_file}') # 执行发邮件操作:filename=(prefix + "_" + cc_file)
关键改动说明
- 新增
file_matched标记,用于记录当前文件是否已找到匹配 - 改用
re.search()替代re.finditer():我们只需要确认文件存在匹配项,不需要获取所有匹配结果,search()找到第一个匹配就返回,效率更高 - 找到匹配后立即
break跳出行循环,终止对当前文件的后续扫描,避免无效遍历 - 使用
with语句管理文件,符合Python资源管理最佳实践,避免文件句柄泄漏
输出结果
pat1 in file1 pat2 in file2
内容的提问来源于stack exchange,提问作者vjeko sa
相关产品推荐
相关产品推荐

