如何用Python Pandas提取CSV文件中指定的第三段数据?
用Pandas提取CSV中符合特定条件第三次出现后的所有数据
直接按以下步骤操作就能拿到你要的第三段数据:
- 加载目标CSV文件
import pandas as pd df = pd.read_csv(path, sep=';')
- 生成匹配目标时间点的布尔掩码
mask = (df['YY'] == 2022) & \ (df['MM'] == 9) & \ (df['DD'] == 1) & \ (df['hh'] == 0) & \ (df['mm'] == 0) & \ (df['ss'] == 0)
- 提取所有符合条件的行的索引
matched_indices = df[mask].index.tolist()
- 定位第三次匹配的位置并截取数据
先确认数据中至少有3个符合条件的行(避免索引越界报错),再从第三个匹配行开始截取到末尾:
if len(matched_indices) >= 3: third_segment = df.loc[matched_indices[2]:] # 可按需保存结果,比如 # third_segment.to_csv('third_segment.csv', sep=';', index=False) else: print("数据中符合条件的行不足3个,请检查数据格式")
最终得到的third_segment就包含了表头和你需要的最后1/3数据段。
内容的提问来源于stack exchange,提问作者Marcin
相关产品推荐
相关产品推荐

