You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何去除CSV文件表头中的特殊字符(含\r回车符)

去除DataFrame表头中的特殊字符(如\r)

针对你遇到的表头含不可见特殊字符(比如\r)的问题,这里有几种实用的处理方案,基于你已导入的DataFrame df 来实现:

方法1:批量去除表头两端的空白类特殊字符

str.strip() 会自动处理所有空白类控制字符(包括\r、\n、\t等),适合快速清理表头前后的冗余字符:

# 清理表头两端的空白类特殊字符
df.columns = df.columns.str.strip()

比如原表头Col1\r会被处理成Col1,\rCol2\n会变成Col2。

方法2:精准替换特定特殊字符

如果只需要处理\r这类指定字符,可以用str.replace直接替换:

# 移除表头中的\r字符
df.columns = df.columns.str.replace('\r', '', regex=False)

# 若需同时处理多个字符(比如\n),可以链式调用
df.columns = df.columns.str.replace('\r', '', regex=False).str.replace('\n', '', regex=False)

设置regex=False是为了把\r当作普通字符串处理,避免正则解析的干扰。

方法3:清理所有非打印ASCII控制字符

如果表头存在多种未知的不可见字符,用正则匹配并移除所有ASCII控制字符(范围\x00-\x1F和\x7F):

import re
# 移除所有非打印的ASCII控制字符
df.columns = df.columns.str.replace(r'[\x00-\x1F\x7F]', '', regex=True)

这个方案覆盖范围最广,能处理绝大多数不可见的特殊字符。

验证结果

处理完成后,打印表头确认效果:

print(df.columns)

内容的提问来源于stack exchange,提问作者malcolm richard

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.20 22:10:01