如何在Pandas DataFrame中实现数据聚合以统计各分类的出现频次
实现方案
有两种常用的实现方式可以满足你的需求:
方法1:使用value_counts()(最简写法)
直接对Country列调用value_counts()方法,即可得到按计数降序排列的统计结果:
# 统计每个国家对应的条目数 df2 = df['Country'].value_counts()
执行后得到的df2默认是Series类型,输出和你需要的格式完全一致。如果需要转换为带显式列名的DataFrame,可以追加reset_index方法:
df2 = df['Country'].value_counts().reset_index(name='Count')
方法2:使用groupby聚合(扩展性更强)
如果后续需要叠加更多聚合逻辑,可以用groupby配合size()实现相同效果:
df2 = df.groupby('Country').size().sort_values(ascending=False)
内容的提问来源于stack exchange,提问作者Kenny_I
相关产品推荐
相关产品推荐

