如何在Pandas中按性别统计响应次数并修正筛选行报错
问题解决
首先,你写的代码报错是因为逻辑运算符&的优先级高于比较运算符==,导致表达式运算顺序错误。正确的筛选写法需要给每个比较条件单独添加括号:
df.loc[(df['Gender'] == 'female') & (df['response'] == 'yes')]
不过你的核心需求是按性别统计响应次数,直接用筛选再计数效率较低,推荐两种更高效的实现方式:
方法1:使用groupby+size
通过分组后统计每组的行数,得到分层索引的统计结果:
df.groupby(['Gender', 'response']).size()
输出结果:
Gender response female no 2 yes 2 male no 1 yes 3 dtype: int64
方法2:使用pd.crosstab
生成交叉表,直接得到直观的统计表格,完全匹配你想要的格式:
import pandas as pd pd.crosstab(df['Gender'], df['response'])
输出结果:
response no yes Gender female 2 2 male 1 3
内容的提问来源于stack exchange,提问作者Encipher
相关产品推荐
相关产品推荐

