Pandas中.append已弃用,如何将DataFrame追加到自身?
Pandas .append()弃用后的替代方案(将DataFrame追加到自身生成重复行)
在新版Pandas中,.append()方法已被弃用,官方推荐使用pd.concat()来实现DataFrame的行拼接,完全可以满足你生成重复行的需求:
替代代码示例
import pandas as pd # 将movies_df追加到自身,生成带重复行的副本 temp_df = pd.concat([movies_df, movies_df], ignore_index=True) # 验证行数是否翻倍 print(temp_df.shape) # 输出示例: (2000, 11)
关键说明
pd.concat()接受一个包含多个DataFrame的列表,传入两个movies_df即可实现和原.append()一致的追加效果ignore_index=True会重置拼接后DataFrame的索引,避免出现重复索引(不需要重置的话可省略该参数)- 该操作返回新的DataFrame副本,不会修改原始的
movies_df,和原教程的行为完全匹配
后续去重演示
生成重复行后,可继续用drop_duplicates()完成教程中的去重验证:
# 去除重复行 deduped_df = temp_df.drop_duplicates() # 验证行数是否回到原始数量 print(deduped_df.shape) # 输出示例: (1000, 11)
内容的提问来源于stack exchange,提问作者half.cab
相关产品推荐
相关产品推荐

