如何用Pandas提取两Excel共同表头并保留第二文件数据生成新文件
解决方法:筛选共同列并保留df2数据
嗨,我懂你要实现的需求啦——其实你不用纠结merge函数,因为它是用来按行合并数据的,而你现在要做的是列筛选,只保留两个DataFrame表头的交集,并且只取df2里的对应数据。下面是具体的实现步骤:
第一步:找出两个DataFrame的共同表头(列名)
我们可以用columns.intersection()方法快速获取两者的交集列:common_columns = df1.columns.intersection(df2.columns)第二步:从df2中提取这些共同列的数据
直接用筛选语法就能得到我们需要的DataFrame:filtered_df = df2[common_columns]第三步:将结果保存为新的Excel文件
用to_excel()方法导出,记得加上index=False避免把行索引也写进去:filtered_df.to_excel("output.xlsx", index=False)
举个你给的例子验证下:
如果df1表头是a、b、c、d,df2表头是a、c,那么common_columns就是['a','c'],filtered_df就会只保留df2里的a、c两列数据,完全符合你的预期~
内容的提问来源于stack exchange,提问作者Roushan Kumar
相关产品推荐
相关产品推荐

