You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Pandas循环读取Excel工作表新增表名列时行值重复如何修复

问题原因

你的代码存在2个核心错误:

  • 每次循环都会覆盖df1变量,第一次读取的L&D1工作表数据直接被丢弃,最终仅保留了L&D2的内容
  • df1 = df1.append(df1)是将当前工作表的数据自身重复拼接,不是将多个工作表的内容合并,int(i)行无实际作用可以删除

修正后代码

import pandas as pd

xls = pd.ExcelFile('sheet2.xlsx')
name_prefix = 'L&D'
# 存储每个工作表处理后的DataFrame
df_collection = []

# 直接遍历工作表序号1、2
for sheet_sn in range(1, 3):
    current_sheet = name_prefix + str(sheet_sn)
    df = pd.read_excel(xls, current_sheet)
    # 过滤Unnamed开头的空列
    df = df.loc[:, ~df.columns.str.contains('^Unnamed')]
    # 新增Emp_No列赋值为工作表名称
    df['Emp_No'] = current_sheet
    df_collection.append(df)

# 合并所有工作表数据,重置索引
final_df = pd.concat(df_collection, ignore_index=True)
# 输出结果
print(final_df)

如果需要将合并结果导出为Excel,可在末尾补充一行:

final_df.to_excel('merged_result.xlsx', index=False)

内容的提问来源于stack exchange,提问作者jeffgrills

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.05 08:30:01