You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何从多个Excel文件中提取Department与Grade列的唯一组合?

提取多份Excel文件中Department与Grade的唯一组合

方法一:用Excel内置Power Query处理(无需编程)

这是最省心的内置方案,操作步骤如下:

  • 新建空白Excel工作簿,点击「数据」选项卡 → 获取数据 → 从文件 → 从文件夹
  • 选择存放目标Excel文件的文件夹,点击「确定」后选择「转换数据」进入Power Query编辑器
  • 点击「添加列」→ 自定义列,输入公式:[Department] & "|" & [Grade](用分隔符拼接两列,方便后续去重)
  • 选中新增的拼接列,点击「开始」→ 删除重复项
  • 右键删除拼接列,只保留Department和Grade两列
  • 点击「关闭并上载」,去重后的组合会直接导入当前工作簿的工作表

方法二:用Python脚本批量处理(适合复杂场景)

如果熟悉Python,可借助pandas库实现自动化:

import pandas as pd
import os

# 替换为你的文件夹路径
folder_path = "C:/Your/Excel/Folder/Path"
unique_pairs = set()

# 遍历文件夹内所有Excel文件
for filename in os.listdir(folder_path):
    if filename.lower().endswith((".xlsx", ".xls")):
        file_full_path = os.path.join(folder_path, filename)
        # 只读取需要的两列,提升效率
        df = pd.read_excel(file_full_path, usecols=["Department", "Grade"])
        # 把每行的列值转成元组,利用集合自动去重
        for _, row in df.dropna().iterrows():
            unique_pairs.add((row["Department"], row["Grade"]))

# 将去重后的结果保存为新Excel
result_df = pd.DataFrame(list(unique_pairs), columns=["Department", "Grade"])
result_df.to_excel("唯一组合结果.xlsx", index=False)

注意:运行前需安装依赖库,执行命令 pip install pandas openpyxl 即可

关键提醒

  • 确保所有文件的列名完全一致(包括大小写、空格),否则会导致读取失败
  • 处理前建议过滤空值,避免生成无效的空组合
  • Power Query支持.xlsx/.xls/.csv等多种格式,无需额外安装工具

内容的提问来源于stack exchange,提问作者Ritam Chakrabarty

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.20 09:32:06