pandas如何删除列名不同但数据完全重复的列?
解决方法
直接通过转置+去重的方式即可自动删除全部数值完全重复的列,无需手动罗列待删除列名:
# 默认保留每一组重复列中的第一列,其余重复列自动删除 df = df.T.drop_duplicates().T
如果需要保留每一组重复列的最后一列,调整keep参数即可:
df = df.T.drop_duplicates(keep='last').T
可选预校验步骤
如果需要提前确认哪些列属于重复列,可以执行以下代码查看:
# 返回布尔值序列,值为True的对应列就是重复列 print(df.T.duplicated())
内容的提问来源于stack exchange,提问作者ahnnni
相关产品推荐
相关产品推荐

