如何基于指定两列筛选dataframe中组合仅出现一次的行
问题原因
你使用的distinct()函数的作用是对指定列做去重,仅保留每个唯一组合的第一条记录,不会过滤掉出现过多次的组合,所以你会得到包含apple+red的结果,不符合需求。
实现代码
你可以先按food和color两列分组,筛选出分组内行数为1的记录即可,有两种常用写法:
- 分组后直接筛选
library(dplyr) df %>% group_by(food, color) %>% filter(n() == 1) %>% ungroup()
- 先追加计数列再筛选
library(dplyr) df %>% add_count(food, color) %>% filter(n == 1) %>% select(-n) # 不需要保留计数列可加这行
两种写法运行后都会得到你预期的结果:
| food | color | popular |
|---|---|---|
| pear | green | no |
| banana | yellow | yes |
内容的提问来源于stack exchange,提问作者JadedKing
相关产品推荐
相关产品推荐

