R语言批量判断指定前缀列含指定字符串并新增变量的方法
实现方案
这里提供两种常用实现方式,均不需要手动指定单个a.前缀列,可自动适配任意数量的符合前缀要求的变量:
1. 基础R实现(无需安装额外依赖包)
# 匹配所有前缀为"a."的列 a_col_index <- grepl("^a\\.", colnames(df)) # 逐行判断是否存在A或B,将逻辑值转为整数0/1 df$result <- as.integer(apply(df[, a_col_index], MARGIN = 1, FUN = function(row) { any(row %in% c("A", "B")) }))
2. tidyverse 实现(适合习惯dplyr语法的用户)
library(dplyr) df <- df %>% # 按行计算 rowwise() %>% mutate( # 匹配所有a.前缀列,判断是否有元素属于A/B,转成0/1 result = as.integer(any(c_across(starts_with("a.")) %in% c("A", "B"))) ) %>% # 取消行分组,避免影响后续数据操作 ungroup()
两种方法运行后得到的结果和你给出的期望输出完全一致,可直接适配你有100个a.前缀变量的场景。
内容的提问来源于stack exchange,提问作者R90
相关产品推荐
相关产品推荐

