如何为数据框分组添加行,使每组行数相等?(优先dplyr实现)
用dplyr实现分组数据框补全行数的方案
直接上可运行的代码,高效解决问题:
library(dplyr) library(tidyr) # 若已加载tidyverse可省略此句 # 你的原始数据 df <- data.frame( group = c("A","A","A","A","B","B","B","C","C"), col1 = c(1, 1, 1, 1, 2, 2, 2, 3, 3), col2 = c(12, 13, 14, 15, 21, 22, 23, 31, 32) ) # 1. 先算出所有组中的最大行数 max_row_count <- df %>% count(group) %>% pull(n) %>% max() # 2. 分组补全数据到最大行数 df_desired <- df %>% group_by(group) %>% summarise( # 批量处理所有列:保留原有数据,补充对应数量的NA across(everything(), ~c(., rep(NA, max_row_count - n()))), .groups = "drop" ) %>% unnest(everything())
操作说明:
- 第一步通过
count统计每组行数,提取最大值作为所有组的目标行数。 - 第二步按
group分组后,用across批量处理每一列:保留原组的已有数据,用rep(NA, ...)生成缺失的行数补全。 - 最后用
unnest把列表格式的列展开,得到和你需求完全匹配的结果,全程是向量化操作,比循环效率高很多。
内容的提问来源于stack exchange,提问作者Max
相关产品推荐
相关产品推荐

