You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何按type分组筛选同时包含正负z-score的数据组?

按type分组筛选z-score同时包含正负值的行

需求:按type列对数据分组,仅保留组内同时存在正z-score和负z-score的所有行(即z-score范围跨越0的type分组)。示例数据test中,预期保留的type为"Translation"、"Signal Transduction"、"Glycan Biosynthesis and Metabolism"和"Genetic Information Processing"。

你的初步尝试问题说明

你写的代码:

out <- test %>% group_by(type) %>% select(zscore < 0 & zscore >0)

存在两个核心问题:

  • select()函数的作用是选择数据列,不是筛选行,筛选行需要用filter()
  • zscore < 0 & zscore > 0是矛盾条件,永远返回FALSE,无法筛选出有效内容

正确解决方案

使用dplyr包的分组筛选逻辑,判断每个分组内是否同时存在正负z-score:

library(dplyr)

# 筛选符合条件的分组行
out <- test %>%
  group_by(type) %>%
  filter(any(zscore > 0) & any(zscore < 0)) %>%
  ungroup() # 可选,取消分组状态,方便后续数据操作

代码解释

  • group_by(type):按type列对数据进行分组
  • filter(any(zscore > 0) & any(zscore < 0)):
    • any(zscore > 0):判断当前分组内是否存在至少一个正z-score值
    • any(zscore < 0):判断当前分组内是否存在至少一个负z-score值
    • 两者结合,仅保留同时满足两个条件的分组的所有行
  • ungroup():取消分组标记,避免后续操作继承分组状态(可根据需求选择是否保留分组)

验证结果

执行以下代码查看筛选后的分组:

unique(out$type)

输出结果应为:

[1] "Genetic Information Processing"    "Glycan Biosynthesis and Metabolism"
[3] "Translation"                       "Signal Transduction"

内容的提问来源于stack exchange,提问作者Geomicro

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.02 17:10:11