如何将存储pandas回归结果的二维字典导出为Excel/CSV文件
报错原因
你触发Must pass 2-d input报错的核心原因是:results_df是键为股票代码、值为单只股票回归结果DataFrame的嵌套字典,不是标准二维表格结构,pandas的IO方法无法直接处理这种嵌套结构,强行转换为DataFrame时会因为维度不匹配报错。
可行导出方案
根据你需要的导出格式,选对应方案即可:
方案1:合并为单张二维表,导出CSV或单Sheet Excel
适合需要所有股票结果集中在同一张表的场景,给每个子表加上股票标识后纵向拼接即可,代码如下:import pandas as pd # 拼接所有子结果为标准二维表 table_list = [] for stock_code, single_res in results_df.items(): # 把行索引(const、hsi_r)转为普通列,命名为factor temp = single_res.reset_index().rename(columns={"index": "factor"}) # 插入股票代码列作为标识 temp.insert(0, "stock_code", stock_code) table_list.append(temp) final_table = pd.concat(table_list, ignore_index=True) # 导出CSV,用utf-8-sig编码避免Excel打开中文乱码 final_table.to_csv("stock_regression_results.csv", index=False, encoding="utf-8-sig") # 导出单Sheet Excel final_table.to_excel("stock_regression_results.xlsx", index=False)拼接完成的表每一行对应单只股票的单个因子回归结果,列包含
stock_code、factor、coeff、pvals、rsqur,完全符合二维表要求,不会触发维度报错。方案2:导出为多Sheet Excel
适合希望每只股票的回归结果单独存放在一个Sheet的场景,不需要做结构转换,用ExcelWriter循环写入即可:with pd.ExcelWriter("stock_regression_multi_sheet.xlsx") as writer: for stock_code, single_res in results_df.items(): # 直接用股票代码作为Sheet名,注意Excel Sheet名长度不能超过31位,不能包含\/?*[]等特殊字符 single_res.to_excel(writer, sheet_name=stock_code)
代码优化提示
你当前构造results_df的逻辑中,rsquared是单值,传入DataFrame构造函数时会自动广播到每一行,属于冗余存储,可以按需调整构造逻辑:如果不需要每行重复存储R²,可以把R²作为单独字段和因子结果分开存储,减少冗余数据。
内容的提问来源于stack exchange,提问作者Steven
相关产品推荐
相关产品推荐

