为何指定on为索引列时pd.merge()仍能正常运行?
Pandas合并行为的解惑
关键原因:Pandas的
merge函数会自动识别左侧DataFrame的命名索引(即rename_axis设置的索引名称),把它当作可用于合并的“虚拟列”,不需要先转成普通列。具体逻辑:
你执行pd.merge(df1, df2, on='ID')时,df1虽然没有名为ID的列,但它的索引被命名为ID,此时merge会自动将这个命名索引纳入匹配范围,相当于隐式实现了left_index=True的效果,直接用左侧的命名索引和右侧的ID列做合并对齐。等价写法验证:
下面两种写法的合并结果完全一致:# 写法1:用on='ID'隐式匹配命名索引 pd.merge(df1, df2, on='ID') # 写法2:显式指定用左侧索引和右侧列匹配 pd.merge(df1, df2, left_index=True, right_on='ID')如何强制仅用列合并:
如果不想依赖这种隐式行为,要严格只按列合并,可以先把df1的命名索引转为普通列:pd.merge(df1.reset_index(), df2, on='ID')
内容的提问来源于stack exchange,提问作者Amin.A
相关产品推荐
相关产品推荐

