如何从多个Excel文件中提取Department与Grade列的唯一组合?
提取多份Excel文件中Department与Grade的唯一组合
方法一:用Excel内置Power Query处理(无需编程)
这是最省心的内置方案,操作步骤如下:
- 新建空白Excel工作簿,点击「数据」选项卡 → 获取数据 → 从文件 → 从文件夹
- 选择存放目标Excel文件的文件夹,点击「确定」后选择「转换数据」进入Power Query编辑器
- 点击「添加列」→ 自定义列,输入公式:
[Department] & "|" & [Grade](用分隔符拼接两列,方便后续去重) - 选中新增的拼接列,点击「开始」→ 删除重复项
- 右键删除拼接列,只保留Department和Grade两列
- 点击「关闭并上载」,去重后的组合会直接导入当前工作簿的工作表
方法二:用Python脚本批量处理(适合复杂场景)
如果熟悉Python,可借助pandas库实现自动化:
import pandas as pd import os # 替换为你的文件夹路径 folder_path = "C:/Your/Excel/Folder/Path" unique_pairs = set() # 遍历文件夹内所有Excel文件 for filename in os.listdir(folder_path): if filename.lower().endswith((".xlsx", ".xls")): file_full_path = os.path.join(folder_path, filename) # 只读取需要的两列,提升效率 df = pd.read_excel(file_full_path, usecols=["Department", "Grade"]) # 把每行的列值转成元组,利用集合自动去重 for _, row in df.dropna().iterrows(): unique_pairs.add((row["Department"], row["Grade"])) # 将去重后的结果保存为新Excel result_df = pd.DataFrame(list(unique_pairs), columns=["Department", "Grade"]) result_df.to_excel("唯一组合结果.xlsx", index=False)
注意:运行前需安装依赖库,执行命令
pip install pandas openpyxl即可
关键提醒
- 确保所有文件的列名完全一致(包括大小写、空格),否则会导致读取失败
- 处理前建议过滤空值,避免生成无效的空组合
- Power Query支持.xlsx/.xls/.csv等多种格式,无需额外安装工具
内容的提问来源于stack exchange,提问作者Ritam Chakrabarty
相关产品推荐
相关产品推荐

