R语言按Class列拆分DataFrame为两个互补列表的实现方法
R语言按分组拆分生成互补子数据框列表方案
初始示例DataFrame
测试数据集构造代码如下:
df <- data.frame(Class = c("A", "B", "C", "D", "E"), Numbers = c(4,2,4,1,4), Names = c("Alice", "Daniel", "Helen", "John", "Alex"), Weight = c(60, 72, 90, 100, 70) )
具体需求
需要创建两个各包含5个DataFrame的列表,规则如下:
第一个列表(
list_1)按df$Class列拆分,每个子DataFrame仅包含对应Class值的行,可直接通过以下代码实现:list_1 <- split(df,df$Class)执行后可得到5个分别对应单个Class的独立DataFrame,效果参考:

第二个列表(
list_2)该部分为待解决问题:同样基于df$Class列拆分,要求list_2中第i个DataFrame为原df排除list_1中第i个DataFrame对应Class行后的全部剩余数据,即两个列表同位置的子DataFrame数据行完全互补。
预期输出效果参考:
实现代码
直接遍历list_1的分组名称做子集筛选即可,保证两个列表索引顺序完全对齐:
# 获取与list_1顺序完全一致的分组名称 group_names <- names(list_1) # 逐组筛选排除当前Class的剩余行 list_2 <- lapply(group_names, function(cls){ df[!df$Class == cls, ] }) # 为list_2设置与list_1一致的名称,方便按组名索引 names(list_2) <- group_names
效果校验
代码执行后可直接验证互补逻辑:对任意索引位置i,将list_1[[i]]和list_2[[i]]按行合并后排序,结果与原df完全一致,无缺行、重复行问题。例如list_2$A即为原df剔除Class为A的行后,剩余的B/C/D/E四个Class对应的所有行,完全匹配预期效果。
内容的提问来源于stack exchange,提问作者Spontaneous
相关产品推荐
相关产品推荐

