如何找出DataFrame中所有Name分组共有的最小Value值
解决方法:找出所有分组共有的最小Value值
首先明确需求:要找的是在每个Name分组的Value中都出现过的数值里,最小的那个(你的例子里结果为3)。你之前用ave添加分组最小值列的思路,只是得到了每个分组自身的最小值,和实际需求不符。
下面用dplyr包给出两种简洁的实现方式:
方法一:通过交集获取共有值
先提取每个分组的唯一Value集合,再求所有集合的交集,最后取交集里的最小值:
library(dplyr) # 提取每个分组的唯一Value列表 group_unique_vals <- mydata %>% group_by(Name) %>% summarise(unique_vals = list(unique(Value))) %>% pull(unique_vals) # 计算所有分组Value的交集,再取最小值 min_common_val <- Reduce(intersect, group_unique_vals) %>% min()
方法二:统计Value的分组覆盖数
先统计每个Value出现在多少个不同分组里,筛选出覆盖所有分组的Value,再取最小值:
library(dplyr) # 获取总分组数量 total_groups <- mydata %>% distinct(Name) %>% nrow() # 筛选出在所有分组都出现的Value,取最小值 min_common_val <- mydata %>% distinct(Name, Value) %>% # 保留每个分组的唯一Value记录 count(Value) %>% # 统计每个Value覆盖的分组数 filter(n == total_groups) %>% # 仅保留覆盖所有分组的Value pull(Value) %>% min()
两种方法最终都会得到你需要的结果3。
内容的提问来源于stack exchange,提问作者LT17
相关产品推荐
相关产品推荐

