You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python Pandas导入Excel:处理嵌套及合并表头问题

动态处理Excel两行嵌套表头的解决方案

直接上可复用的代码逻辑,适配带空白/合并单元格的第一行表头:

import pandas as pd

def load_excel_with_multi_header(file_path, sep='_'):
    # 读取前两行表头数据
    header_rows = pd.read_excel(file_path, nrows=2, header=None)
    # 前向填充第一行的空白单元格(对应合并列的后续单元格)
    header_rows.iloc[0] = header_rows.iloc[0].ffill()
    # 拼接两行表头为单行,用指定分隔符连接
    combined_header = [f"{h1}{sep}{h2}" for h1, h2 in zip(header_rows.iloc[0], header_rows.iloc[1])]
    # 读取实际数据,跳过前两行表头
    df = pd.read_excel(file_path, skiprows=2, header=None)
    # 设置合并后的表头
    df.columns = combined_header
    return df

# 调用示例
df = load_excel_with_multi_header('your_excel_file.xlsx', sep='_')

关键逻辑说明

  • 读取表头行:单独读取前两行,避免和数据混在一起处理
  • 前向填充(ffill):自动处理第一行的空白/合并单元格,把合并列的表头值填充到所有对应列的第一行位置
  • 动态拼接:遍历两行表头的每一列,自动拼接成单行表头,不管表头列数多少都能适配
  • 分隔符可自定义:如果不想用下划线,传入sep=' '或者sep='/'即可调整拼接格式

特殊情况适配

如果第一行表头的最后几列是空白(合并列在末尾),ffill会自动用最后一个有效值填充,不会出现拼接错误;如果第二行有重复值,拼接后会保留区分(比如总金额_金额1、总金额_金额2),避免列名重复。

内容的提问来源于stack exchange,提问作者SkB

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.14 14:27:10