Excel Remove Duplicates、Combination of Values:如何保留两列唯一值并删重复项?
嘿,这个需求得先明确下具体场景——你是想每一列各自保留唯一值(比如A列重复的只留一个,B列重复的也只留一个),还是想两列的组合是唯一值(比如(A,B)这个配对不重复)?我给你分别说下最简实现方法:
场景1:每列各自保留唯一值
用Excel操作(适合非编程场景)
- 选中第一列需要处理的数据区域
- 点击顶部菜单栏的「数据」选项卡 → 选择「删除重复值」
- 在弹出的对话框里,确保只勾选当前操作的这一列,点击「确定」后,该列的重复项就会被删除,仅保留唯一值
- 对第二列重复以上步骤即可
用Python Pandas实现(适合批量/自动化处理)
一行代码就能搞定,保留每列第一次出现的唯一值:
import pandas as pd df = pd.read_excel("你的数据文件路径.xlsx") # 读取数据 # 对每列分别去重 df_unique_cols = df.apply(lambda column: column.drop_duplicates(), axis=0)
场景2:两列组合为唯一值(即配对不重复)
这种场景下,只有当两列的值同时重复时才会删除行,适合需要保留唯一配对的情况。
用Excel操作
- 选中包含这两列的整个数据区域(如果有其他关联列也可以一起选中)
- 点击「数据」→「删除重复值」
- 在对话框中同时勾选这两列,点击「确定」后,就会删除两列组合重复的行,仅保留唯一配对
用Python Pandas实现
同样一行核心代码,保留第一次出现的唯一配对:
# 按指定的两列去重,keep参数可选"first"/"last"/False(删除所有重复项) df_unique_pair = df.drop_duplicates(subset=["列1名称", "列2名称"], keep="first")
如果你的需求有更细节的调整(比如要保留最后出现的重复项、处理空值等),随时补充说明就行~
内容的提问来源于stack exchange,提问作者Deluq
相关产品推荐
相关产品推荐

