在长DataFrame中搜索字符串并返回同ID对应所有字符串的实现
实现方法
直接通过向量匹配与字符串拼接即可完成需求,以下是适配你数据集的函数实现:
# 定义核心函数 get_same_id_names <- function(df, search_term) { # 获取目标字符串对应的ID target_id <- df$id[df$name == search_term] # 处理无匹配的情况 if (length(target_id) == 0) { return("未找到匹配的字符串") } # 提取同ID下的所有名称并拼接为逗号分隔的字符串 paste(df$name[df$id == target_id[1]], collapse = ", ") } # 测试示例 df <- data.frame(id = c(3,3,3,55,55,55,63,63,63), name = c("house","home","apartment","boat","ship","sailboat","car","automobile","truck")) # 调用测试 get_same_id_names(df, "house") # 输出结果:"house, home, apartment"
关键说明
- 采用向量操作替代循环,适配15000行的数据集,执行效率更高
- 若存在同一个
name对应多个id的特殊场景,当前函数会取第一个匹配的id;如需覆盖所有关联ID,可修改为unique(target_id)后批量提取 - 加入无匹配时的提示逻辑,避免返回空向量
内容的提问来源于stack exchange,提问作者user7264
相关产品推荐
相关产品推荐

