如何在Pandas中按id分组计算score列的众数?
按ID分组计算Score列众数的解决方案
嘿,我来帮你搞定这个问题!你需要先按id分组,再对每个组的score列计算众数,之前的写法没用到分组逻辑,所以达不到预期效果。这里有两种实用的实现方式:
方式一:Groupby + Mode(兼容多众数场景)
如果某个分组里存在多个众数(比如多个值出现次数相同),mode()会返回所有众数,我们可以用iloc[0]取第一个结果,保证每组只输出一个值:
import pandas as pd # 假设你的数据已存储在df这个DataFrame中 result_df = df.groupby('id')['score'].apply(lambda group: group.mode().iloc[0]).reset_index()
运行后就能得到你想要的结果:
id score
222.0 1.0
416.0 0.0
895.0 0.0
方式二:用Value_counts取频次最高值
另一种思路是对每个分组的score做频次统计,直接取出现次数最多的第一个值:
result_df = df.groupby('id')['score'].apply(lambda group: group.value_counts().index[0]).reset_index()
小提醒
你之前尝试的df['score'] = df.mode()是对整个DataFrame计算众数,不是按id分组聚合,所以没法得到按ID分组的目标结果,一定要记得先执行groupby('id')再进行聚合操作哦~
内容的提问来源于stack exchange,提问作者abhjt
相关产品推荐
相关产品推荐

