如何使用Python从Excel多列数据生成指定格式的嵌套统计字典
Python读取Excel统计生成指定嵌套字典的实现方案
- 需求说明:读取包含University(大学名称)、Year(年份)两列的Excel文件,按大学名称分组统计各年份的出现次数,最终生成值为字符串格式的嵌套字典。
- 依赖安装:使用pandas处理表格数据,执行以下命令安装所需依赖:
pip install pandas openpyxl - 实现代码:
import pandas as pd from collections import Counter # 替换为你自己的Excel文件路径 df = pd.read_excel("你的文件路径.xlsx", dtype={"Year": str}) result = {} # 按大学名称分组遍历 for uni, group_df in df.groupby("University"): # 统计当前大学各年份出现次数,将统计值转为字符串格式 year_cnt = Counter(group_df["Year"]) result[uni] = {year: str(cnt) for year, cnt in year_cnt.items()} # 打印输出验证结果 print(result)
- 输出结果与要求完全一致:
{ 'IUB': {'2013': '3', '2014': '1', '2015': '1'}, 'BZU': {'2013': '2', '2014': '1'}, 'UCP': {'2013': '1', '2014': '1', '2016': '2'} }
内容的提问来源于stack exchange,提问作者Ali Jafar
相关产品推荐
相关产品推荐

