R提取dataframe中V开头且值含F的列序号并计算对应均值
问题根源
该问题由R语言data.frame的单列索引默认降维特性导致,和c()没有直接关联:
- 当
Splitframe[ , grepl( "F" , Splitframe) ]的筛选结果仅为1列时,R会自动将返回结果从data.frame结构降级为普通向量,向量不存在colnames属性,因此colnames(...)会返回NULL - 后续执行
names(DF) %in% NULL时所有匹配结果均为FALSE,which()最终返回空值numeric(0)
快速修复方案
在索引逻辑中添加drop = FALSE参数,强制筛选结果始终返回data.frame结构,不受返回列数影响:
which(names(DF) %in% colnames(Splitframe[ , grepl( "F" , Splitframe), drop = FALSE ])) + 1
使用你提供的示例DF运行上述代码,可得到正确结果[1] 6,对应原DF中V01_Code列的序号。
完整需求实现
以下代码可直接实现你提到的全部业务逻辑,无需提前拆分子集,容错性更高:
# 筛选符合条件的列:列序号>=6 + 列名以V开头 + 列值包含字符"F" target_cols <- which(seq_along(DF) >= 6 & startsWith(names(DF), "V") & apply(DF, 2, function(col) any(grepl("F", col)))) # 计算均值,无符合条件列时返回NA res_mean <- if (length(target_cols) > 0) mean(unlist(DF[, target_cols]), na.rm = TRUE) else NA
内容的提问来源于stack exchange,提问作者Mr.Spock
相关产品推荐
相关产品推荐

