R语言数据框索引漏写逗号:为何未报错且返回异常结果?
R语言data.frame索引漏写逗号的问题解析
先回顾你的代码场景:
创建数据框的代码:
Country <- c("USA", "GBR", "CHN") Gold<-c(46,27,26) Silver=c(37,23,18) Bronze=c(38,17,26) medals <- data.frame(Country, Gold, Silver, Bronze)
正确的行筛选代码:
medals[medals$Gold >= 27,]
你误写的代码:
medals[medals$Gold >= 27]
为什么没有触发报错?
R语言中data.frame本质是列向量组成的列表,[索引符对它有两种合法用法:
- 双索引格式:
df[行索引, 列索引],用于同时筛选行和列 - 单索引格式:
df[索引],此时索引会被用于筛选列,只要索引是合法类型(逻辑向量、整数向量、列名向量),就不会触发报错。
你写的medals$Gold >=27会生成一个长度为3的逻辑向量:c(TRUE, TRUE, FALSE),这属于合法的列筛选索引,因此R会正常执行而不报错。
异常结果的生成依据
当用单逻辑向量索引data.frame时,R会将这个向量与数据框的列位置一一对应,保留逻辑值为TRUE的列,返回这些列的所有行。
你的逻辑向量c(TRUE, TRUE, FALSE)对应medals的第1、2列(Country和Gold列),因此执行medals[medals$Gold >= 27]后返回的结果是:
Country Gold 1 USA 46 2 GBR 27 3 CHN 26
而你原本需要的是筛选行,必须通过逗号明确分隔行索引和列索引:逗号前是行筛选条件,逗号后留空表示保留所有列,这样才能得到金牌数≥27的行数据。
内容的提问来源于stack exchange,提问作者Zaid
相关产品推荐
相关产品推荐

