使用pandas合并重复行并拼接重复行对应第二列内容的实现方法
pandas 重复行指定列内容拼接实现方法
直接通过groupby分组+agg聚合即可完成需求,完整可运行代码如下:
import pandas as pd # 构造示例DataFrame df = pd.DataFrame({ 'A': ['A001','A002','A002','A003'], 'B': ['ROW1','ROW2','ROW3','ROW4'] }) # 按A列去重,同组B列内容拼接 result_df = df.groupby('A', as_index=False, sort=False)['B'].agg(''.join) print(result_df)
代码说明
groupby('A'):指定按A列进行分组,相同值的行归为同一组as_index=False:指定分组后的A列不作为索引,保留普通列格式sort=False:保留A列值在原始数据中首次出现的顺序,不做升序排序agg(''.join):将同组内所有B列的字符串按出现顺序直接拼接
运行输出结果和要求完全一致:
A B 0 A001 ROW1 1 A002 ROW2ROW3 2 A003 ROW4
内容的提问来源于stack exchange,提问作者Jagadeeshkumar Viswanathan
相关产品推荐
相关产品推荐

