Excel如何根据指定列的匹配值删除整行重复数据
Excel 操作步骤
- 多列对比去重(比如B、E列值相同判定为重复)
- 新增空白辅助列,第一行输入公式
=B2&E2,把两列内容拼接成单独的判断值,下拉填充所有行 - 再新增第二个辅助列,第一行输入公式
=COUNTIF($F$2:F2,F2),此处F列替换为你第一步创建的拼接辅助列的列号,下拉填充。所有值为1的行就是对应重复项第一次出现的行 - 筛选第二个辅助列值为1的所有行,直接删除即可满足你「删除重复项里第一次出现的行」的需求
- 新增空白辅助列,第一行输入公式
- 单列对比去重(比如仅看「numero du certificat」列)
把第一步的拼接公式改成直接引用该列即可,后续步骤和上面一致。
Python Pandas 代码方案
如果是用代码批量处理,直接调用pandas内置的去重方法即可:
import pandas as pd # 读取源文件,csv格式换用pd.read_csv df = pd.read_excel("你的本地文件路径.xlsx") # 多列去重:subset参数传入要判断重复的列名,keep='last'代表重复项只保留最后一次出现的行,即删除第一次出现的重复行 df = df.drop_duplicates(subset=["B列的实际列名", "E列的实际列名"], keep="last") # 单列去重就把subset改成对应列名即可 # df = df.drop_duplicates(subset=["numero du certificat..."], keep="last") # 导出处理后的文件 df.to_excel("处理完成的文件.xlsx", index=False)
内容的提问来源于stack exchange,提问作者Chadi N
相关产品推荐
相关产品推荐

