You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用dplyr将观测值均匀随机分配至两组?

使用dplyr实现等量随机分组

可以用dplyr结合基础R的sample()函数实现这个需求,以下是两种靠谱的方法:

  • 方法一:生成随机打乱的分组向量
library(dplyr)

# 假设你的数据框名为df
df <- df %>%
  mutate(group = sample(c(rep(1, 1000), rep(2, 1000))))

先创建包含1000个1和1000个2的向量,再通过sample()打乱顺序,最后绑定为新变量,确保两组数量严格相等且分配随机。

  • 方法二:先随机排序再按行号分组
df <- df %>%
  slice_sample(n = nrow(.)) %>%  # 随机打乱数据行的顺序
  mutate(group = if_else(row_number() <= 1000, 1, 2))

先通过slice_sample()随机重排所有行,再根据行号将前1000行标记为1,后1000行标记为2,同样能实现需求。

这两种方法都无需额外依赖其他包,仅用dplyr和基础R功能即可完成。

内容的提问来源于stack exchange,提问作者Dr. Know Nothing

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.20 09:45:40