Python筛选数据集后如何将过滤结果保存为Excel文件
pandas筛选指定品类数据并导出Excel方法
你当前的筛选写法存在冗余问题:逐行apply执行全列匹配效率极低,且返回的是布尔值矩阵,无法直接得到筛选后的目标数据集,正确操作步骤如下:
- 安装导出Excel需要的依赖(已安装可跳过)
pip install openpyxl pandas
- 直接使用pandas布尔索引完成筛选,不需要调用
apply
# 指定需要保留的商品品类 keep_categories = ['Alkoholna pića','Bezalkoholna pića','Prerada voća povrća i med'] # 筛选得到符合条件的子集,非匹配数据会被直接排除 filtered_df = Katalog_final[Katalog_final['PROGRAM (robna grupa)'].isin(keep_categories)]
- 将筛选结果导出为Excel文件
# index=False 表示不导出pandas默认的行序号列 filtered_df.to_excel("筛选后商品数据.xlsx", index=False)
- 可选校验步骤:执行以下代码可以打印筛选前后的数据行数,确认筛选结果符合预期
print(f"原始数据总行数:{len(Katalog_final)}") print(f"筛选后保留行数:{len(filtered_df)}")
内容的提问来源于stack exchange,提问作者Adi Šehić
相关产品推荐
相关产品推荐

