如何修改pandas读取CSV后生成的DataFrame输出格式?
问题结论
该需求完全可以实现。
你当前用pandas.read_csv("sample.csv", sep=";")读取得到的DataFrame和预期效果不符,核心原因是读取时没有将存储行维度标签的第一列指定为索引,导致pandas把行标签识别成了普通数据列,同时自动生成了默认的整数索引,出现结构错位。
具体操作方法
调整读取代码,在read_csv中增加index_col=0参数,明确指定CSV的第一列作为DataFrame的行索引即可:
import pandas as pd # 修正后的CSV读取代码 df = pd.read_csv("sample.csv", sep=";", index_col=0)
注:
index_col参数接收列的位置序号或者列名,传入0代表将CSV中第一列作为行索引,适配你当前的CSV文件结构。
如果读取完成后列名和你预期的record1/record2/record3不一致,补充一行重命名列的代码即可:
df.columns = ["record1", "record2", "record3"]
效果对照
- 调整前的输出效果:

- 调整后的预期输出效果:

内容的提问来源于stack exchange,提问作者Sotos Athanasiou
相关产品推荐
相关产品推荐

