如何实现Python脚本每10分钟自动运行生成CSV并覆盖旧文件
问题解决
你遇到的IndentationError: expected an indented block报错是因为Python语法要求循环、条件判断等代码块内的内容必须统一缩进,你之前把业务代码放在for循环中时没有做缩进处理才触发了该报错。
方案1:Python脚本内实现定时运行(最简单,无需额外配置系统任务)
以下是修改后的完整可运行代码,将业务逻辑封装后通过循环+等待实现每10分钟执行一次,同名导出文件会自动覆盖旧文件:
import csv import pandas as pd import numpy as np import time from pandas import Series, DataFrame def process_and_export(): df = pd.read_csv('C:/Users/Desktop/case_study_1.csv', low_memory=False) # 转换interaction_time为日期时间格式 df.interaction_time = pd.to_datetime(df.interaction_time) # 清除merchant列空值 df_remove_null = df.dropna(subset=['merchant']) # 统计交易数量 df_cnt = df_remove_null.groupby([pd.Grouper(key='interaction_time', freq='H'), df_remove_null.fullVisitorid, df_remove_null.action_type]).size().reset_index(name='count') df_final_cnt = df_cnt.groupby(['interaction_time', 'action_type'])['fullVisitorid'].size().reset_index(name='count') # 导出CSV文件,同名文件自动覆盖旧文件 df_final_cnt.to_csv(r'C:\Users\Desktop\filename12.csv', index=False, columns=["interaction_time", "action_type", "count"]) if __name__ == "__main__": while True: process_and_export() # 10分钟对应600秒,单次执行完成后等待600秒再运行下一次 time.sleep(600)
该方案注意事项:
- 运行脚本后不要关闭对应的命令行/终端窗口,关闭后定时任务会停止
- 如果需要限制运行次数,可以把
while True替换为你需要的循环次数,比如for _ in range(100)即可实现运行100次后自动停止
方案2:系统级定时任务(无需长期挂着脚本,运行更稳定)
如果不需要脚本一直在后台挂着,可以使用系统自带的定时任务功能实现:
- Windows系统:打开「任务计划程序」,新建触发规则为每10分钟触发一次的任务,操作项设置为启动你的Python解释器,参数填写该脚本的绝对路径即可
- Linux/macOS系统:使用crontab服务,添加定时规则
*/10 * * * * python3 你的脚本绝对路径即可生效
内容的提问来源于stack exchange,提问作者Amatuer
相关产品推荐
相关产品推荐

