You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何基于指定两列筛选dataframe中组合仅出现一次的行

问题原因

你使用的distinct()函数的作用是对指定列做去重,仅保留每个唯一组合的第一条记录,不会过滤掉出现过多次的组合,所以你会得到包含apple+red的结果,不符合需求。

实现代码

你可以先按food和color两列分组,筛选出分组内行数为1的记录即可,有两种常用写法:

  1. 分组后直接筛选
library(dplyr)
df %>%
  group_by(food, color) %>%
  filter(n() == 1) %>%
  ungroup()
  1. 先追加计数列再筛选
library(dplyr)
df %>%
  add_count(food, color) %>%
  filter(n == 1) %>%
  select(-n) # 不需要保留计数列可加这行

两种写法运行后都会得到你预期的结果:

foodcolorpopular
peargreenno
bananayellowyes

内容的提问来源于stack exchange,提问作者JadedKing

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.27 19:06:03