如何在Pandas中按分隔符'\'将单列拆分为多列?
解决Pandas拆分制表符分隔单列数据的问题
问题根源
你用read_fwf(固定宽度读取)加载文件,导致原本制表符分隔的多列被合并成了单列;另外手动给字符串拼接r''完全没用——DataFrame里的\t是制表符字符,不是\加t两个字符,所以用split('\\')(拆分反斜杠)找不到匹配项。
方法一:读取文件时直接拆分多列(推荐)
你的文件是制表符分隔,直接用read_csv指定分隔符为\t,同时跳过无关行,一步到位得到多列DataFrame:
import pandas as pd df = pd.read_csv('my_file.txt', sep='\t', skiprows=8)
方法二:已读成单列后再拆分
如果已经用read_fwf得到了单列DataFrame,直接按制表符拆分即可:
# 拆分单列,expand=True会把拆分结果转为多列 split_df = df['column1\tcolumn2\tcolumn3'].str.split('\t', expand=True) # 给新列命名 split_df.columns = ['column1', 'column2', 'column3']
关键注意点
- 不要手动拼接
r'':这只会在字符串前后添加r'和',不会改变原有字符串里的制表符内容。 - 区分分隔符:如果你的文件确实是反斜杠(不是制表符)作为分隔符,拆分时用
split('\\')(因为Python里反斜杠需要转义),但从你的示例数据看,实际是制表符\t。
内容的提问来源于stack exchange,提问作者Anya Pilipentseva
相关产品推荐
相关产品推荐

