如何在Jupyter Notebook中不使用.drop调用.describe()分析指定数据
解决方法
不用drop修改原数据的话,有两种简单可行的方式:
直接筛选目标列进行统计
不用改动原数据集,直接在调用describe()前筛选出需要保留的列。先定义要排除的列名列表,然后通过列名匹配筛选出剩余列,再生成统计表格:exclude_cols = ['anaemia', 'diabetes', 'ejection_fraction', 'high_blood_pressure', 'platelets', 'sex', 'smoking', 'DEATH_EVENT'] # 筛选出非排除列并生成统计结果 heart_failure.loc[:, ~heart_failure.columns.isin(exclude_cols)].describe()这里
~表示取反,.isin()用来判断列是否在排除列表中,原heart_failure数据全程不会被修改。基于原数据副本操作
先复制一份原数据到新变量,再对副本执行drop操作,这样原数据完全不受影响:exclude_cols = ['anaemia', 'diabetes', 'ejection_fraction', 'high_blood_pressure', 'platelets', 'sex', 'smoking', 'DEATH_EVENT'] # 创建原数据的深拷贝 heart_failure_copy = heart_failure.copy() # 对副本删除指定列 heart_failure_copy.drop(exclude_cols, axis=1, inplace=True) # 生成统计表格 heart_failure_copy.describe()后续绘图需要原数据时,直接使用原始的
heart_failure变量即可。
内容的提问来源于stack exchange,提问作者Ethan
相关产品推荐
相关产品推荐

