如何利用ID列表修改DataFrame中指定行的rating_denominator值为10?
问题解决方法
核心错误分析
你的代码存在两个关键问题:
- 误用比较运算符
==代替赋值运算符=,导致仅做了相等判断,完全没有修改数据 - 遍历单个ID逐个修改的方式,对大型数据集来说效率极低,会消耗大量运算资源
修正后的遍历方法(适合小型数据集)
如果只想快速修正逻辑,把比较运算符改成赋值即可:
denominator_cleaning_list = ['832088576586297345', '820690176645140481', '775096608509886464'] for element in denominator_cleaning_list: cleaning_df.loc[element, 'rating_denominator'] = 10 # 将==替换为=
高效批量修改方法(推荐给大型数据集)
利用isin()方法批量匹配目标ID,一次完成所有修改,性能提升明显:
denominator_cleaning_list = ['832088576586297345', '820690176645140481', '775096608509886464'] # 若ID是DataFrame的索引 cleaning_df.loc[cleaning_df.index.isin(denominator_cleaning_list), 'rating_denominator'] = 10
如果ID不是索引,而是单独的一列(例如列名为id),调整代码如下:
# 若ID存储在名为'id'的列中 cleaning_df.loc[cleaning_df['id'].isin(denominator_cleaning_list), 'rating_denominator'] = 10
内容的提问来源于stack exchange,提问作者Wildo_Baggins311
相关产品推荐
相关产品推荐

