如何用Python Pandas读取指定Excel文件并实现分组计数排序?
问题修复:Pandas读取Excel分组计数并排序
代码中的问题点
- 拼写错误:
pd.read.excel应为pd.read_excel(Pandas方法名采用下划线连接,而非点) - 冗余操作:无需创建空列
Recordinaciones来实现分组计数,空列的count()结果始终为1,无法真实统计每组数据量
修复后的代码
import pandas as pd doc = input('Ingresa el nombre del archivo: ') print(f'Ingresaste {doc}') # 修复文件读取方法的拼写错误 df = pd.read_excel(doc) # 直接分组统计每组行数,无需额外空列 rcs = df.groupby(['Cliente', '# Externo']).size().reset_index(name='Recordinaciones') # 按计数结果降序排序 rcs = rcs.sort_values('Recordinaciones', ascending=False) # 输出结果 print(rcs)
说明
- 修正
read_excel的拼写错误后,才能正常读取Excel文件 - 使用
groupby().size()直接统计每组的条目数量,结果准确且效率更高 - 通过
reset_index(name='Recordinaciones')将统计结果命名为目标列名 - 若Excel文件不在当前运行目录,需输入完整文件路径(如
./data/mi_archivo.xlsx)
内容的提问来源于stack exchange,提问作者Franco Vera
相关产品推荐
相关产品推荐

