如何用Pandas合并Column_id缺失行的statements至同一行?
Pandas合并Column_id为NaN的多行statements
原始数据
| Column_id | statements |
|---|---|
| a1 | My dog |
| NaN | ate |
| NaN | a bone |
| a2 | an apple, |
| NaN | banana & |
| NaN | orange |
期望结果
| Column_id | statements |
|---|---|
| a1 | My dog ate a bone |
| a2 | an apple, banana & orange |
实现代码
import pandas as pd # 前向填充Column_id的NaN值,统一同组行的标识 df['Column_id'] = df['Column_id'].ffill() # 按Column_id分组,合并对应statements文本 result_df = df.groupby('Column_id')['statements'].agg(' '.join).reset_index()
代码说明
ffill():把Column_id列的NaN值替换为上一个非空的ID,让归属同一组的行拥有相同标识。groupby('Column_id')['statements'].agg(' '.join):按ID分组后,用空格拼接每组内的所有statements内容。reset_index():重置分组后的索引,得到结构规整的结果DataFrame。
内容的提问来源于stack exchange,提问作者priyal shah
相关产品推荐
相关产品推荐

