You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Pandas按指定分组逐行计算分组内当前累计最大值问题

正确实现方案

你需要使用分组累计最大值方法cummax()实现需求,修改后的代码如下:

import pandas as pd

# 读入数据部分保持你原来的写法即可
df = pd.read_csv('C:/Users/.../a.csv', names=['group_letter', 'digit', 'col_ok'], index_col=0)
# 按group_letter分组后对digit列计算累计最大值
df['cumulatively'] = df.groupby('group_letter')['digit'].cummax()
print(df)

原代码错误原因

  1. transform('max')计算的是每个分组的全局最大值,同一个分组所有行返回的都是该组的整体最大值,不符合逐行累计计算到当前行最大值的需求
  2. 原代码统计时错误选取了col_ok列进行计算,按照你的需求应该选取digit列计算最大值

运行上述修改后的代码,得到的cumulatively列就会和你手动录入的col_ok列结果完全一致。


内容的提问来源于stack exchange,提问作者gregorylenartowicz

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.29 09:24:04