You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何为Pandas DataFrame每个分组新增占组内总值100%的占比列

Pandas DataFrame按分组计算字段占比实现方法

核心实现代码

无需循环遍历,直接使用groupby+transform即可一行完成需求:

# 计算占比(返回小数形式)
df7['perc'] = df7.groupby('group')['test'].transform(lambda x: x / x.sum())

# 如果需要显示为带%的百分比格式,可使用以下代码
df7['perc'] = df7.groupby('group')['test'].transform(lambda x: (x / x.sum() * 100).round(2)).astype(str) + '%'

transform方法会将分组后的聚合计算结果映射回原数据的每一行,刚好匹配每行显示对应分组占比的需求,且执行效率远高于自行编写的遍历循环。

原代码错误原因

  • 每次循环迭代都会对整个perc列重新赋值,最终整列仅会保留最后一次迭代对应分组的计算结果,无法为所有分组正确计算占比
  • 手动遍历全表的实现效率极低,不适用于数据量较大的DataFrame

内容的提问来源于stack exchange,提问作者Sinethemba Imesim Makoma

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.03 14:06:00