Excel表格合并重复编码行对应唯一URL的高效处理方法
高效解决方案
方案1:使用Excel自带Power Query(零代码,无卡顿)
Power Query是Office内置的结构化数据处理工具,十万行级数据处理无压力,操作步骤如下:
- 选中原始数据全量区域,点击「数据」选项卡 → 「从表格/区域」,将数据导入Power Query编辑器
- 同时选中SKU、EAN两列,右键选择「分组依据」:新列名填写
URL集合,操作选择「所有行」,确认设置 - 点击
URL集合列右上角的扩展按钮,仅勾选「URL」列,取消「使用原始列名作为前缀」的勾选,确认扩展 - 再次同时选中SKU、EAN两列,点击「转换」选项卡 → 「透视列」:值列选择「URL」,聚合值函数选择「不要聚合」
- 工具会自动生成URL1、URL2……对应列,最多到你需要的20列
- 最后点击「关闭并上载」,直接导出结果到Excel工作表即可,全程不会出现公式计算卡顿崩溃的问题
方案2:Python Pandas代码方案(处理速度最快,支持百万行级数据)
如果有基础代码操作能力,用该方案处理11万行数据耗时不超过3秒,参考代码如下:
import pandas as pd # 读取原始Excel,替换为你本地的文件路径 df = pd.read_excel("原始数据文件.xlsx") # 按SKU+EAN分组,给组内的URL按顺序编号 df["url序号"] = df.groupby(["SKU", "EAN"]).cumcount() + 1 # 透视转换,把URL从行转成列 result_df = df.pivot(index=["SKU", "EAN"], columns="url序号", values="URL").reset_index() # 重命名列,符合URL1~URL20的命名要求 result_df.columns = ["SKU", "EAN"] + [f"URL{i}" for i in result_df.columns[2:]] # 导出结果到新Excel result_df.to_excel("URL整理结果.xlsx", index=False)
运行前需先安装依赖,执行命令pip install pandas openpyxl即可
内容的提问来源于stack exchange,提问作者Aevir Denken
相关产品推荐
相关产品推荐

