如何在Pandas中仅删除列表最后一个重复的"A"而非全部重复项?
如何仅删除DataFrame列表中的最后一个"A"
你现在用drop_duplicates(keep=False)会把所有重复的元素(也就是两个"A")都删掉,这就导致结果只剩B、C了。要实现只删除最后一个"A",保留第一个"A"和其他元素,这里有两种简单的方法:
方法1:定位最后一个"A"的索引后删除
先找到所有值为"A"的行的索引,取最后一个索引再删除对应的行:
import pandas as pd df = pd.DataFrame({'ID': ["A", "B", "C", "A"]}) # 获取所有"A"对应的索引,取最后一个 last_a_index = df[df['ID'] == 'A'].index[-1] # 删除该行 df.drop(last_a_index, inplace=True) print(df)
运行后输出的结果就是:
ID 0 A 1 B 2 C
方法2:用布尔索引筛选目标行
通过创建掩码,标记出需要保留的行——对于"A"只保留非最后一次出现的,其他元素全部保留:
import pandas as pd df = pd.DataFrame({'ID': ["A", "B", "C", "A"]}) # 生成掩码:排除最后一个"A"的行 mask = ~((df['ID'] == 'A') & (df.index == df[df['ID'] == 'A'].index[-1])) # 筛选保留的行 df = df[mask] print(df)
这个方法同样能得到你想要的A、B、C结果。
内容的提问来源于stack exchange,提问作者bogdann
相关产品推荐
相关产品推荐

