You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Pandas分组聚合时保留重复值首行col1、末行col2的实现方法

解决方案

使用pandas的分组聚合agg方法,为不同列指定对应聚合规则即可实现需求:

  • col1列使用first聚合,取分组内第一条记录的值
  • col2列使用last聚合,取分组内最后一条记录的值
  • col4列使用sum聚合,对分组内所有值求和

对应实现代码如下:

# as_index=False 避免col3成为索引列
df = df.groupby('col3', as_index=False).agg(
    col1=('col1', 'first'),
    col2=('col2', 'last'),
    col4=('col4', 'sum')
)
# 调整列顺序匹配你需要的输出格式
df = df[['col1', 'col2', 'col3', 'col4']]

如果使用的是pandas 0.25之前的旧版本,可使用字典格式传入聚合规则:

df = df.groupby('col3', as_index=False).agg({
    'col1': 'first',
    'col2': 'last',
    'col4': 'sum'
})
df = df[['col1', 'col2', 'col3', 'col4']]

内容的提问来源于stack exchange,提问作者user14603676

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.25 07:15:04