如何在R DataFrame中添加含两列元素所有可能组合的行
别纠结标题的事儿啦,完全能明白你的需求——就是想找出这两列元素之间的所有可能组合对吧?我用R给你分两种常见场景来解决:
场景1:生成所有可能的笛卡尔积(包含重复/反向/自身组合)
如果你想要把obj1里的每一个元素,都和obj2里的每一个元素配对一遍(哪怕是像A-B和B-A这种反向组合,或者元素和自身的组合),用expand.grid()函数就搞定了,简单粗暴:
# 先构造你的数据框(把示例里的"..."换成实际元素,这里假设是"G") df <- data.frame( obj1 = c("A", "B", "C", "D", "E", "F"), obj2 = c("B", "C", "D", "E", "F", "G") ) # 生成所有笛卡尔积组合 all_combinations <- expand.grid(df$obj1, df$obj2, stringsAsFactors = FALSE) # 给列名改得更清晰 colnames(all_combinations) <- c("from_obj1", "from_obj2") # 查看结果 print(all_combinations)
运行后会得到6×6=36种组合,涵盖所有可能的配对情况。
场景2:生成无重复的唯一两两配对(无反向、无自身)
如果你想要的是不考虑顺序的唯一配对(比如只保留A-B,不会出现B-A,同时排除A-A这种自身配对),可以先把两列的元素合并去重,再用combn()函数生成组合:
# 合并两列的所有唯一元素 all_unique_objs <- unique(c(df$obj1, df$obj2)) # 生成所有2个元素的无序唯一组合 unique_pairs <- t(combn(all_unique_objs, 2)) # 转成数据框方便查看 unique_pairs_df <- as.data.frame(unique_pairs, stringsAsFactors = FALSE) colnames(unique_pairs_df) <- c("first_obj", "second_obj") # 查看结果 print(unique_pairs_df)
这个代码会生成所有不重复的无序配对,比如(A,B)、(A,C)...(F,G),完全不会有重复的反向组合。
要是你obj2里的"..."代表还有更多元素,只需要把这些元素补充到数据框里,上面的代码照样能用哦~
内容的提问来源于stack exchange,提问作者blazej
相关产品推荐
相关产品推荐

