You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用Pandas创建仅包含重复id的id、name列新DataFrame

解决方法

要保留所有存在重复id的记录,只取id和name列,关键是要把所有重复出现的id对应的行都筛选出来,而不是只筛掉第一次出现的重复项。你之前用duplicated没得到预期结果,大概率是没设置keep=False参数。

直接用下面的代码就能实现:

# 假设原DataFrame名为df
result_df = df[df.duplicated(subset='id', keep=False)][['id', 'name']]

代码说明:

  • df.duplicated(subset='id', keep=False):subset='id'指定只按id列判断重复;keep=False会把所有重复的行都标记为True,不管是第一次还是后续出现的重复id。
  • 用这个布尔索引筛选出所有重复行后,再通过[['id', 'name']]提取需要的两列,得到目标DataFrame。

内容的提问来源于stack exchange,提问作者johnbumble

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.25 23:39:21