如何将Python Pandas中DataFrame的ID列去重后保存为CSV文件?
解决方法:对ID列去重后保存为CSV
嗨,这个需求很容易实现,Pandas的drop_duplicates()方法正好能帮你搞定ID列的去重操作,只需要在原代码的基础上添加这个方法调用就行啦!
核心修改代码
把你原来的代码改成下面这样,就能先对ID列去重,再保存到CSV文件:
df['ID'].drop_duplicates().to_csv('file.csv', index=False)
关键细节说明
drop_duplicates():这是Pandas Series/DataFrame的内置方法,默认会保留每个重复值的第一次出现,去掉后续的重复项。index=False:这个参数是为了避免把Pandas默认的索引列写入CSV文件,如果你不需要额外的索引列,建议加上它,这样生成的CSV里就只有去重后的ID值了。
可选参数扩展
如果你的需求有变化,还可以调整drop_duplicates()的参数:
- 想保留每个重复值的最后一次出现:
df['ID'].drop_duplicates(keep='last').to_csv('file.csv', index=False) - 想删除所有出现过重复的ID(只保留仅出现一次的ID):
df['ID'].drop_duplicates(keep=False).to_csv('file.csv', index=False)
内容的提问来源于stack exchange,提问作者jeangelj
相关产品推荐
相关产品推荐

