Pandas设置DataFrame索引和表头后如何删除首行BLANK及下方0值
你现有代码运行后得到的结果里,表头第一个位置的BLANK是列索引的名称属性,下方的0是行索引的名称属性,只需要在现有代码后追加两行代码即可清除这两个多余值:
# 清除列索引名称,即表头最左侧的BLANK df.columns.name = None # 清除行索引名称,即BLANK下方的0 df.index.name = None
如果需要更严谨的全流程处理逻辑,避免手动删除行索引可能出现的误差,也可以用如下方式从头处理原始DataFrame:
# 提取第3行(索引为2)从第二列开始的值作为表头 new_header = df.iloc[2, 1:].tolist() # 从第5行(索引为4)开始取有效数据,将第一列设为行索引 df = df.iloc[4:, :].set_index(df.columns[0]) # 给有效数据设置列名 df.columns = new_header # 清除多余的行索引名称 df.index.name = None
运行后即可得到你需要的目标格式。
内容的提问来源于stack exchange,提问作者Kim Minseo
相关产品推荐
相关产品推荐

