遍历pandas DataFrame列表添加标识列时全填充为最后一个值如何解决
错误原因
你的代码问题出在函数内部的冗余循环逻辑:对每个单独的DataFrame执行mindex函数时,你都会遍历整个字符串列表重复给Strings列赋值,最终列值自然只会保留字符串列表的最后一个元素。同时不需要在函数内部遍历DataFrame行或者字符串列表,只需要在遍历DataFrame列表时,取出对应位置的字符串直接赋值即可。
正确实现代码
# 注意把你原来存df的变量名从df改成df_list,避免和单个df变量混淆 df_list = [df1, df2, df3] strings = ['df1', 'df2', 'df3'] def process_df(df, string_label): # 重置时间索引 df.reset_index(inplace=True) # 直接插入指定字符串到Strings列,不需要额外循环 df.insert(1, "Strings", string_label) # 用zip同时遍历df列表和对应的字符串列表,一一对应赋值 for df, label in zip(df_list, strings): process_df(df, label)
可选优化
如果你不想修改原始DataFrame,可以调整函数返回新的处理后对象:
def process_df(df, string_label): new_df = df.reset_index() new_df.insert(1, "Strings", string_label) return new_df # 推导式生成新的处理后df列表 processed_df_list = [process_df(df, label) for df, label in zip(df_list, strings)]
如果担心两个列表长度不匹配可以提前加校验:
assert len(df_list) == len(strings), "DataFrame列表和字符串标签列表长度不一致,请检查数据"
内容的提问来源于stack exchange,提问作者lostinpython
相关产品推荐
相关产品推荐

