Pandas循环读取Excel工作表新增表名列时行值重复如何修复
问题原因
你的代码存在2个核心错误:
- 每次循环都会覆盖
df1变量,第一次读取的L&D1工作表数据直接被丢弃,最终仅保留了L&D2的内容 df1 = df1.append(df1)是将当前工作表的数据自身重复拼接,不是将多个工作表的内容合并,int(i)行无实际作用可以删除
修正后代码
import pandas as pd xls = pd.ExcelFile('sheet2.xlsx') name_prefix = 'L&D' # 存储每个工作表处理后的DataFrame df_collection = [] # 直接遍历工作表序号1、2 for sheet_sn in range(1, 3): current_sheet = name_prefix + str(sheet_sn) df = pd.read_excel(xls, current_sheet) # 过滤Unnamed开头的空列 df = df.loc[:, ~df.columns.str.contains('^Unnamed')] # 新增Emp_No列赋值为工作表名称 df['Emp_No'] = current_sheet df_collection.append(df) # 合并所有工作表数据,重置索引 final_df = pd.concat(df_collection, ignore_index=True) # 输出结果 print(final_df)
如果需要将合并结果导出为Excel,可在末尾补充一行:
final_df.to_excel('merged_result.xlsx', index=False)
内容的提问来源于stack exchange,提问作者jeffgrills
相关产品推荐
相关产品推荐

