You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何为数据框分组添加行,使每组行数相等?(优先dplyr实现)

用dplyr实现分组数据框补全行数的方案

直接上可运行的代码,高效解决问题:

library(dplyr)
library(tidyr) # 若已加载tidyverse可省略此句

# 你的原始数据
df <- data.frame(
  group = c("A","A","A","A","B","B","B","C","C"),  
  col1 = c(1, 1, 1, 1, 2, 2, 2, 3, 3),
  col2 = c(12, 13, 14, 15, 21, 22, 23, 31, 32)
)

# 1. 先算出所有组中的最大行数
max_row_count <- df %>% 
  count(group) %>% 
  pull(n) %>% 
  max()

# 2. 分组补全数据到最大行数
df_desired <- df %>%
  group_by(group) %>%
  summarise(
    # 批量处理所有列:保留原有数据,补充对应数量的NA
    across(everything(), ~c(., rep(NA, max_row_count - n()))),
    .groups = "drop"
  ) %>%
  unnest(everything())

操作说明:

  • 第一步通过count统计每组行数,提取最大值作为所有组的目标行数。
  • 第二步按group分组后,用across批量处理每一列:保留原组的已有数据,用rep(NA, ...)生成缺失的行数补全。
  • 最后用unnest把列表格式的列展开,得到和你需求完全匹配的结果,全程是向量化操作,比循环效率高很多。

内容的提问来源于stack exchange,提问作者Max

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.02 05:45:38