如何解决pandas处理后CSV数据未拆分至指定多列的问题?
解决方法
1. 正确读取原始文本文件
你的问题核心是读取文件时没指定正确的分隔符,原文件用任意数量空格分隔数据,默认的逗号分隔符无法拆分列。直接读取时指定分隔符并设置列名即可:
import pandas as pd # 读取文件时直接拆分列,指定列名 train = pd.read_csv( r"../input/covidxct/train_COVIDx_CT-3A.txt", sep='\s+', # 匹配任意数量的空格作为分隔符 names=['filename','class','xmin','ymin','xmax','ymax'] )
2. 保存为拆分后的CSV
此时数据已经正确分到6列,直接保存即可:
train.to_csv(r"../working/test/train.csv", index=None)
为什么你的原有代码无效?
- 第一次
pd.read_csv没指定分隔符,默认按逗号拆分,但原文件没有逗号,所有数据被塞进同一列。 - 转存为TSV只是把这一列数据用制表符保存,本质还是单列表格,没有完成拆分。
内容的提问来源于stack exchange,提问作者zampoan
相关产品推荐
相关产品推荐

