读取Excel文件时如何去除Pandas表头中的换行符
解决Pandas读取Excel时去除表头换行符的问题
你之前用skiprows=1无效是因为这个参数的作用是跳过指定行数、将后续行设为表头,根本不是用来处理现有表头里的换行符的。
正确的做法是先正常读取文件,再单独处理表头的换行符:
- 正常读取Excel文件(保留原表头):
import pandas as pd df = pd.read_excel('S:/DataToClean.xlsm')
- 替换表头中的换行符(覆盖
\n和\r两种常见换行格式):
# 直接删除换行符 df.columns = df.columns.str.replace('\n', '').str.replace('\r', '') # 也可以把换行符替换成空格,让表头更易读 # df.columns = df.columns.str.replace('\n', ' ').str.replace('\r', ' ')
如果表头里还有制表符这类其他空白字符,用正则表达式能一次性处理:
import re df.columns = [re.sub(r'[\n\r\t]', '', col) for col in df.columns]
这样就能彻底清除表头里的换行符了。
内容的提问来源于stack exchange,提问作者Jack
相关产品推荐
相关产品推荐

