Pandas合并DataFrame后导出CSV出现无名索引列的原因
问题成因分析
问题的核心原因是pandas导出CSV时默认会写入DataFrame的行索引,而读取时会把这个无列名的索引列识别为普通数据列:
- 导出环节:执行
df5.to_csv(csv_buffer)时,pandas默认将DataFrame的行索引(即合并后df5的0、1、2行号)写入CSV的第一列,这一列在CSV文件中没有列名。 - 读取环节:使用
pd.read_csv()读取该CSV时,因为第一列没有列名,pandas会自动为其分配Unnamed: 0作为列名,最终导致读取后的DataFrame多了一列,总列数从337变为338。
解决办法
你可以通过两种方式避免这个问题:
- 导出CSV时禁用索引写入:
df5.to_csv(csv_buffer, index=False)
- 读取CSV时将第一列指定为行索引:
df1 = pd.read_csv(StringIO(contents), parse_dates=['datecreated'], index_col=0)
内容的提问来源于stack exchange,提问作者Leb_Broth
相关产品推荐
相关产品推荐

