You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Jupyter Notebook中不使用.drop调用.describe()分析指定数据

解决方法

不用drop修改原数据的话,有两种简单可行的方式:

  • 直接筛选目标列进行统计
    不用改动原数据集,直接在调用describe()前筛选出需要保留的列。先定义要排除的列名列表,然后通过列名匹配筛选出剩余列,再生成统计表格:

    exclude_cols = ['anaemia', 'diabetes', 'ejection_fraction', 'high_blood_pressure', 'platelets', 'sex', 'smoking', 'DEATH_EVENT']
    # 筛选出非排除列并生成统计结果
    heart_failure.loc[:, ~heart_failure.columns.isin(exclude_cols)].describe()
    

    这里~表示取反,.isin()用来判断列是否在排除列表中,原heart_failure数据全程不会被修改。

  • 基于原数据副本操作
    先复制一份原数据到新变量,再对副本执行drop操作,这样原数据完全不受影响:

    exclude_cols = ['anaemia', 'diabetes', 'ejection_fraction', 'high_blood_pressure', 'platelets', 'sex', 'smoking', 'DEATH_EVENT']
    # 创建原数据的深拷贝
    heart_failure_copy = heart_failure.copy()
    # 对副本删除指定列
    heart_failure_copy.drop(exclude_cols, axis=1, inplace=True)
    # 生成统计表格
    heart_failure_copy.describe()
    

    后续绘图需要原数据时,直接使用原始的heart_failure变量即可。

内容的提问来源于stack exchange,提问作者Ethan

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.11 15:39:53