You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在pandas多级索引DataFrame中基于分组最大值新增指定列

解决方案

生成Step2列

你可以用groupby搭配transform方法实现需求,transform会将分组后的聚合结果广播到组内所有行,返回的结果长度和原DataFrame完全一致,可以直接赋值为新列:

# 按索引级Hour分组,对Step1求最大值后广播到组内所有行
df['Step2'] = df.groupby(level='Hour')['Step1'].transform('max')

如果你的多级索引没有显式命名,也可以用索引序号指定分组级别:

df['Step2'] = df.groupby(level=0)['Step1'].transform('max')

生成Step3列

基于已经生成的Step2列,用where做条件筛选即可:仅当Level索引值为Level_0时保留最大值,其余行默认填充NaN(即不展示值)

# 提取Level索引的值做判断
df['Step3'] = df['Step2'].where(df.index.get_level_values('Level') == 'Level_0')

如果不想依赖Step2列,也可以直接写为一行:

df['Step3'] = df.groupby(level='Hour')['Step1'].transform('max').where(df.index.get_level_values('Level') == 'Level_0')

内容的提问来源于stack exchange,提问作者hbstha123

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.07 01:36:03