如何更新Pandas DataFrame中的向量字段?解决赋值报错问题
解决Pandas中更新DataFrame向量字段的ValueError问题
错误原因
你遇到的ValueError: Must have equal len keys and value when setting with an iterable,是因为Pandas默认会把np.array((1,2,3))当成长度为3的可迭代序列,尝试将数组的每个元素分别分配给选中的行,但你选中的是2行(a>1对应的two和three),两者长度不匹配,导致报错。
解决方法
以下两种方式可以让Pandas将整个向量作为单个值赋给目标行:
方法1:将向量包装为匹配长度的序列
直接生成一个和选中行数量一致的列表,每个元素都是目标向量,再赋值:
# 获取选中行的子集 target_rows = df.loc[df["a"]>1] df.loc[df["a"]>1, "vec"] = [np.array((1,2,3))] * len(target_rows)
或者用pd.Series指定索引,避免索引不匹配的问题:
df.loc[df["a"]>1, "vec"] = pd.Series( [np.array((1,2,3))]*len(target_rows), index=target_rows.index )
方法2:使用apply逐行赋值
通过apply函数为每一行单独设置目标向量,明确告诉Pandas每个位置要赋值的是单个向量:
df.loc[df["a"]>1, "vec"] = df.loc[df["a"]>1].apply( lambda _: np.array((1,2,3)), axis=1 )
验证结果
执行上述代码后,查看DataFrame:
print(df)
输出如下:
a b vec one 1 4 (10, 11, 12) two 2 5 (1, 2, 3) three 3 6 (1, 2, 3)
内容的提问来源于stack exchange,提问作者Honza S.
相关产品推荐
相关产品推荐

