如何在Python中设置随机种子以获取重复的data.sample采样结果?
解决R中重复抽取相同样本的问题
- 你犯了一个常见的小错误:R里设置随机种子的函数是
set.seed(),不是random.seed()(那是Python的写法)。 - 正确的操作逻辑是:每次抽取样本前都要重新设置同一个种子,这样才能得到完全相同的样本。
- 示例代码:
# 第一次抽取样本 set.seed(10) sample1 <- data.sample(n = 1000) # 第二次抽取完全相同的样本 set.seed(10) sample2 <- data.sample(n = 1000) # 可以用这行代码验证两个样本是否一致 all.equal(sample1, sample2)
- 补充说明:
set.seed()是用来初始化随机数生成器的,只要每次调用sample()前用同一个种子值初始化,生成的随机序列就会完全一致。如果只设置一次种子,第二次调用sample()会接着上次的序列生成新结果,所以必须每次抽取前都重新设置。
内容的提问来源于stack exchange,提问作者Programming Noob
相关产品推荐
相关产品推荐

