请求帮助:合并DataFrame中相同值对应文本为单行拼接形式
解决方法
方法一:Excel Power Query(高效可视化操作)
- 选中你的数据区域,点击「数据」选项卡 → 「从表格/区域」,确认数据包含表头
- 进入Power Query编辑器后,选中
en列,点击「转换」选项卡 → 「分组依据」 - 分组设置:
- 分组列:选择
en - 新列名:自定义为「合并后的ko」
- 操作:选择「所有行」
- 确定后,添加自定义列,输入公式
Text.Combine([分组后的行][ko], ",") - 删除多余的「分组后的行」列,点击「关闭并上载」,就能得到合并完成的表格
- 分组列:选择
方法二:Excel公式(适合小体量数据)
假设数据在A列(en)、B列(ko),第一行是表头,在C2单元格输入公式:
=TEXTJOIN(",", TRUE, IF($A$2:$A$100=A2, $B$2:$B$100, ""))
输入完成后按 Ctrl+Shift+Enter 触发数组公式(Excel 365/2021版本直接回车即可),下拉填充后,对A列去重,保留每个en值对应的第一行C列内容即可
方法三:Python pandas 代码(适合大数据量)
如果数据量较大,用代码处理效率更高:
import pandas as pd # 读取数据,支持csv或Excel文件 df = pd.read_csv("你的数据文件.csv") # 读取Excel可替换为:df = pd.read_excel("你的数据文件.xlsx") # 按en列分组,将对应ko列的文本用逗号拼接 merged_df = df.groupby("en")["ko"].agg(lambda x: ",".join(x)).reset_index() # 保存结果到新文件 merged_df.to_csv("合并后的结果.csv", index=False) # 保存到Excel可替换为:merged_df.to_excel("合并后的结果.xlsx", index=False)
内容的提问来源于stack exchange,提问作者이승우
相关产品推荐
相关产品推荐

