Pandas DataFrame 分组排序后获取每个组前两行的实现方法问询
实现方案
假设你已排序的DataFrame名为df,分组依据的前两列列名为col1、col2(可替换为实际列名),直接通过groupby配合head方法即可实现需求,无需额外排序逻辑:
# 最简实现,适配绝大多数场景 result = df.groupby(['col1', 'col2'], group_keys=False).head(2)
如果需要兼容旧版本pandas,也可以用apply方式实现:
# 兼容旧版本的实现方式 result = df.groupby(['col1', 'col2'], group_keys=False).apply(lambda x: x.iloc[:2]).reset_index(drop=True)
注意事项
- 上述代码默认保留DataFrame原有索引,如果需要重置索引可以在末尾追加
.reset_index(drop=True) - 参数
group_keys=False的作用是避免分组键被额外插入结果结构中,保持和原DataFrame一致的列结构

内容的提问来源于stack exchange,提问作者Amer Sohail
相关产品推荐
相关产品推荐

