如何使用Python为Pandas DataFrame生成符合指定递变规则的列表类型列
解决Pandas DataFrame生成动态递变列表列的问题
嘿,我明白你要实现的这个动态列表生成逻辑了,直接上代码和解释,保证和你要的结果完全匹配:
完整代码实现
import pandas as pd # 初始化两个DataFrame values_to_repeat = [0.33, 0.28, 0.18] df1 = pd.DataFrame({'values_to_repeat': values_to_repeat}) values_to_call = [0,1,2,0,0,0] df2 = pd.DataFrame({'values_to_call': values_to_call}) # 初始化结果列表,每一行对应一个空列表 result = [[] for _ in range(len(df2))] # 遍历每一行,根据调用次数生成对应行的列表元素 for idx, call_count in enumerate(df2['values_to_call']): if call_count == 0: continue # 当前行添加call_count个第一个值(0.33) result[idx].extend([values_to_repeat[0]] * call_count) # 下一行添加call_count个第二个值(0.28)(如果行存在) if idx + 1 < len(df2): result[idx+1].extend([values_to_repeat[1]] * call_count) # 下两行添加call_count个第三个值(0.18)(如果行存在) if idx + 2 < len(df2): result[idx+2].extend([values_to_repeat[2]] * call_count) # 将结果添加为新列 df2['generated_list'] = result # 查看最终结果 print(df2)
运行结果
values_to_call generated_list 0 0 [] 1 1 [0.33] 2 2 [0.28, 0.33, 0.33] 3 0 [0.18, 0.28, 0.28] 4 0 [0.18, 0.18] 5 0 []
逐行逻辑解释
我们的核心思路是追踪每个调用的生命周期:每一次调用生成的元素会在当前行是0.33,下一行变成0.28,再下一行变成0.18,之后消失。具体对应你的需求:
- 第0行:调用次数为0,没有任何元素生成,所以是空列表。
- 第1行:调用次数为1,直接添加1个0.33;同时为第2行预留1个0.28,为第3行预留1个0.18。
- 第2行:调用次数为2,添加2个0.33,再加上第1行预留的1个0.28,组合成
[0.28, 0.33, 0.33];同时为第3行预留2个0.28,为第4行预留2个0.18。 - 第3行:调用次数为0,只接收第1行预留的1个0.18和第2行预留的2个0.28,组合成
[0.18, 0.28, 0.28]。 - 第4行:调用次数为0,只接收第2行预留的2个0.18,所以是
[0.18, 0.18]。 - 第5行:所有之前的调用都已经过了3行的生命周期(第2行的调用到第4行是最后一次出现),所以是空列表。
这个方法逻辑直观,容易理解,完全贴合你描述的规则,而且对于小规模数据运行效率也没问题。如果是大规模数据,也可以改成更向量化的实现,但这个版本足够清晰好用。
内容的提问来源于stack exchange,提问作者Lorenzo Damiani
相关产品推荐
相关产品推荐

