You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何统计DataFrame指定列中各重复值的出现次数?

统计DataFrame指定列的重复值出现次数
  • 用pandas内置的value_counts()方法就能直接实现需求,它会返回一个Series:索引是列中的唯一值,对应的值就是该值的重复次数,默认按次数降序排列:

    import pandas as pd
    
    # 替换成你的DataFrame名称和目标列名
    repeat_counts = df['target_column'].value_counts()
    print(repeat_counts)
    
  • 要是只需要重复次数≥2的结果,直接加个筛选即可:

    # 过滤出重复出现的项
    only_duplicates = df['target_column'].value_counts()[lambda x: x >= 2]
    print(only_duplicates)
    
  • 如果需要字典格式的结果(方便后续业务处理),调用to_dict()转换:

    # 完整统计的字典
    count_dict = df['target_column'].value_counts().to_dict()
    # 仅保留重复项的字典
    duplicate_count_dict = {k: v for k, v in count_dict.items() if v >= 2}
    

内容的提问来源于stack exchange,提问作者VIshwa

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.17 22:40:48