在R语言中合并两列为一列且无重复值的实现方法
解决方法:合并两列并生成不重复的球队列
假设你使用Python的pandas库处理数据,这里提供两种简洁的实现方式:
方法一:直接拼接列后去重
先构造示例数据框(若你的数据框已存在,可跳过此步骤):
import pandas as pd df = pd.DataFrame({ 'HomeTeam': ['Zimbabwe', 'Netherlands', 'Kenya'], 'AwayTeam': ['Kenya', 'Zimbabwe', 'Amsterdam'] })
执行合并去重操作:
# 纵向拼接两列,去重后转为带Team列的数据框 unique_teams = pd.concat([df['HomeTeam'], df['AwayTeam']]).drop_duplicates() result_df = pd.DataFrame({'Team': unique_teams}).reset_index(drop=True)
方法二:用melt转换长格式后去重
基于上述数据框,通过melt将宽表转为长表再处理:
# 转换为长格式,保留球队名称列,去重后重置索引 melted = df.melt(value_vars=['HomeTeam', 'AwayTeam'], value_name='Team').drop(columns='variable') result_df = melted.drop_duplicates().reset_index(drop=True)
两种方法最终得到的结果一致:
Team 0 Zimbabwe 1 Netherlands 2 Kenya 3 Amsterdam
内容的提问来源于stack exchange,提问作者IAwa
相关产品推荐
相关产品推荐

