如何使用dplyr实现R语言中的数据解聚操作?
用dplyr实现按age列重复行的解聚操作
首先还原你的原始数据集:
library(dplyr) a <- data.frame(name = c("Maria", "Tina"), age = c(5, 3)) a
方法1:使用uncount()(推荐,更简洁)
dplyr的uncount()函数专门用于按指定次数重复行,完全匹配你的需求。先给每行标记原始行号,再按age列的值展开:
aa <- a %>% mutate(rows = row_number()) %>% uncount(age) aa
输出结果:
name age rows 1 Maria 5 1 2 Maria 5 1 3 Maria 5 1 4 Maria 5 1 5 Maria 5 1 6 Tina 3 2 7 Tina 3 2 8 Tina 3 2
方法2:贴近Base R逻辑的slice()实现
如果想沿用Base R中rep()的思路,用slice()也能实现:
aa <- a %>% slice(rep(row_number(), age)) %>% mutate(rows = rep(seq(nrow(a)), a$age)) aa
这个方法先通过slice(rep(row_number(), age))重复行,再用mutate添加标记原始行号的rows列,结果和Base R实现完全一致。
内容的提问来源于stack exchange,提问作者Salvador
相关产品推荐
相关产品推荐

