Real time clocking out system相关文件词汇过滤功能实现求助
实时打卡系统文件过滤功能实现方案
核心实现逻辑
- 逐行读取原始打卡日志文件,适配大体积日志场景
- 对每行内容做关键词匹配,仅保留包含
clock in的条目 - 将符合要求的条目逐行写入新的文本文件,保留原条目格式
示例实现代码(Python)
# 配置参数,替换为你实际的文件路径即可 original_log_path = "你的原始打卡日志文件路径.txt" filtered_result_path = "上班打卡记录汇总.txt" filter_keyword = "clock in" # 执行过滤写入逻辑 with open(original_log_path, 'r', encoding='utf-8') as read_file: with open(filtered_result_path, 'w', encoding='utf-8') as write_file: for single_line in read_file: # 包含目标关键词的行直接写入新文件 if filter_keyword in single_line: write_file.write(single_line)
无过滤效果常见排查方向
- 路径配置错误:确认原始日志文件的路径填写正确,相对路径需和代码运行的工作目录匹配,不确定时可填写完整绝对路径
- 编码不匹配:如果你的日志文件是GBK等其他编码,把
encoding='utf-8'替换为对应编码即可 - 大小写不匹配:如果日志中关键词存在大小写混用的情况,可把匹配逻辑改为
if filter_keyword.lower() in single_line.lower():即可兼容 - 关键词拼写错误:确认原始日志里的打卡条目关键词和你设置的
filter_keyword完全一致
内容的提问来源于stack exchange,提问作者Emmanuel Smith
相关产品推荐
相关产品推荐

