如何导出清洗后的DataFrame至CSV?导出文件未更新问题求助
导出清洗后DataFrame与原始数据一致的解决办法
排查方向及修复步骤
清洗操作未生效到目标DataFrame
Pandas多数数据处理方法默认返回新的DataFrame对象,不会直接修改原数据。比如使用drop()、fillna()、replace()时,若未添加inplace=True参数,原df_train完全没变化。
修复方式二选一:# 方式1:将清洗结果重新赋值给df_train df_train = df_train.drop(columns=['冗余列']) # 方式2:直接在原DataFrame上修改 df_train.drop(columns=['冗余列'], inplace=True)导出了未清洗的原变量
如果你把清洗后的数据存到了新变量(比如cleaned_df),但导出时仍用了原始的df_train,自然会得到旧数据。
修复:确认导出的是清洗后的变量:cleaned_df = df_train.drop(columns=['冗余列']) cleaned_df.to_csv('../datasets/new_train.csv')文件路径错误,打开了旧文件
检查../datasets/new_train.csv的相对路径是否正确——可能新文件导出到了其他目录,你打开的还是原始数据集的文件。
修复:先打印当前工作目录,核对路径是否匹配:import os print(os.getcwd())找到正确的文件位置后再打开查看。
文件查看器缓存旧内容
部分编辑器或文件预览工具会缓存文件内容,导致你看到的不是最新导出的结果。
修复:关闭文件后重新打开,或者用记事本等无缓存的工具查看。
内容的提问来源于stack exchange,提问作者ricenix
相关产品推荐
相关产品推荐

