Python计算结果无法写入Excel指定列的技术求助
问题排查与修复方案
核心问题分析
- 列名大小写不匹配:初始化
output时定义的列是AC_Change,但循环赋值时用的是AC_change(小写c),Pandas会将其识别为新列,导致原AC_Change列始终为空。 - 年份筛选类型错误:DataFrame中
YEAR是整数类型,代码里却用字符串["2018"]筛选,无法匹配数据,最终total_2018和total_2021均为0,计算结果无意义。 - 低效的DataFrame操作:先创建空列再逐行追加的方式易引发索引问题,且运行效率较低。
修复后的完整代码
import pandas as pd # 读取原始数据 df = pd.read_excel(r"C:\Users\blakecar\PycharmProjects\LFS Data\Mock File LFS.xlsx", sheet_name='Sheet1') def calculate_absolute_change(geog): # 一次性筛选目标国家、地区和变量 filtered_df = df[(df["COUNTRY"] == geog) & (df["REGION_2D"] == "AT10") & (df["Variable"] == "ILOSTAT_W")] # 按年份分组求和,简化重复筛选逻辑 year_totals = filtered_df.groupby("YEAR")["value"].sum() # 获取对应年份的值,无数据则返回0避免报错 total_2018 = year_totals.get(2018, 0) total_2021 = year_totals.get(2021, 0) return total_2018 - total_2021 # 收集所有国家的计算结果 results = [] for geog in df['COUNTRY'].unique(): ac_change = calculate_absolute_change(geog) results.append({"Country": geog, "AC_Change": ac_change}) # 生成最终输出DataFrame output = pd.DataFrame(results) # 保存到Excel文件 output.to_excel('Mock File.xlsx', index=False)
修复关键点说明
- 统一列名为
AC_Change,确保赋值时列名完全匹配; - 使用整数类型的年份(2018、2021)筛选,匹配原始数据类型;
- 改用
groupby按年份求和,简化代码逻辑并提升效率; - 通过列表收集数据后一次性生成DataFrame,避免索引异常。
内容的提问来源于stack exchange,提问作者rogue1
相关产品推荐
相关产品推荐

