使用Pandas处理Excel分组数据时循环未迭代下一组的问题排查
问题分析与解决
原代码的问题
- 逻辑嵌套矛盾:内层的
if row["A"] != x写在了外层if (row["A"] == x)的代码块里——外层已经确认当前行A列等于x了,内层再判断不等于x完全不成立,所以x = x + 0.25永远不会执行,x一直停在0,自然只能输出第一组数据。 - 遍历逻辑不合理:用
iterrows()逐行遍历的方式,既不符合Pandas高效处理数据的思路,也没考虑到分组可能不按顺序排列的情况,就算逻辑改对了也容易出错。
正确的实现方式
方法一:用Pandas的groupby(推荐,符合Pandas最佳实践)
直接按A列分组,自动处理所有分组,不管分组顺序如何都能正确输出:
import pandas as pd df = pd.read_excel(r"C:\data.xlsx", usecols="A, B") # 按A列分组,按分组值排序后遍历输出 for group_val, group_data in df.groupby("A").sort_index(): print(f"分组 {group_val} 对应的B列数据:") print(group_data["B"].tolist()) print("---")
方法二:修正循环逻辑(如果一定要用逐行遍历)
先提取所有唯一分组并排序,再逐个输出对应B列数据:
import pandas as pd df = pd.read_excel(r"C:\data.xlsx", usecols="A, B") # 获取所有唯一分组并按顺序排序 group_values = sorted(df["A"].unique()) for x in group_values: print(f"分组 {x} 对应的B列数据:") # 筛选当前分组的所有B列数据并逐行输出 for b_val in df[df["A"] == x]["B"]: print(b_val) print("---")
内容的提问来源于stack exchange,提问作者Stripers247
相关产品推荐
相关产品推荐

