如何统计DataFrame指定列中各重复值的出现次数?
统计DataFrame指定列的重复值出现次数
用pandas内置的
value_counts()方法就能直接实现需求,它会返回一个Series:索引是列中的唯一值,对应的值就是该值的重复次数,默认按次数降序排列:import pandas as pd # 替换成你的DataFrame名称和目标列名 repeat_counts = df['target_column'].value_counts() print(repeat_counts)要是只需要重复次数≥2的结果,直接加个筛选即可:
# 过滤出重复出现的项 only_duplicates = df['target_column'].value_counts()[lambda x: x >= 2] print(only_duplicates)如果需要字典格式的结果(方便后续业务处理),调用
to_dict()转换:# 完整统计的字典 count_dict = df['target_column'].value_counts().to_dict() # 仅保留重复项的字典 duplicate_count_dict = {k: v for k, v in count_dict.items() if v >= 2}
内容的提问来源于stack exchange,提问作者VIshwa
相关产品推荐
相关产品推荐

