按user_id分组判断并填充retention_1d列的技术需求
原数据表
| user_id | days_since_install |
|---|---|
| 001 | 0 |
| 001 | 1 |
| 001 | 1 |
处理需求
按user_id分组,检查每组的days_since_install列是否存在值1:
- 存在则在
retention_1d列填入True - 不存在则填入
False
预期生成数据表
| user_id | retention_1d |
|---|---|
| 001 | True |
实现方案(Python Pandas)
import pandas as pd # 构造原始数据 df = pd.DataFrame({ 'user_id': ['001', '001', '001'], 'days_since_install': [0, 1, 1] }) # 分组判断并生成结果 result_df = df.groupby('user_id')['days_since_install'].apply(lambda group: 1 in group.values).reset_index(name='retention_1d') print(result_df)
内容的提问来源于stack exchange,提问作者spacenew
相关产品推荐
相关产品推荐

