You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Pandas中按每日b>1000条件选取连续12行数据?

要实现按日从第一个b>1000的行开始取连续12行的需求,咱们可以用Pandas的分组功能配合自定义逻辑来完成,具体步骤如下:

步骤1:预处理日期列

首先得确保你的Date列是datetime格式,这样才能准确按天分组:

import pandas as pd

# 假设你的数据已经读入为df,先转换日期列
df['Date'] = pd.to_datetime(df['Date'])

步骤2:定义分组处理逻辑

接下来写一个函数,专门处理单天的数据:找到当天第一行满足b>1000的记录,然后从该行开始提取连续12行。同时还会处理“当天没有符合条件的行”这种边界情况:

def get_daily_target_rows(group):
    # 找到当天第一个b>1000的行的索引
    first_match_idx = group[group['b'] > 1000].index.min()
    
    # 如果当天没有符合条件的行,返回空DataFrame(可根据需求调整)
    if pd.isna(first_match_idx):
        return pd.DataFrame()
    
    # 从匹配的索引开始取最多12行
    return group.loc[first_match_idx:].head(12)

步骤3:分组应用并合并结果

最后按日期分组,把上面的函数应用到每个分组,再合并成最终的结果:

# 按日期的“天”部分分组(比如2018-01-09)
final_result = df.groupby(df['Date'].dt.date).apply(get_daily_target_rows).reset_index(drop=True)

关键细节说明

  • 用index.min()确保我们取的是当天第一个满足b>1000的行,而不是随便某一行;
  • head(12)保证即使从匹配行到当天结束不足12行,也只会取现有所有行,不会报错;
  • reset_index(drop=True)是为了去掉分组后产生的多层索引,让结果的结构更整洁。

用你提供的示例数据测试的话,这个逻辑会准确从2018-01-09的5:30那一行开始,提取后续12行,完全符合你的预期结果。

内容的提问来源于stack exchange,提问作者jerry han

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.15 04:39:58