You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言数据处理:按配对规则保留dummy变量有效值

R数据处理:按配对规则筛选dummy值

需求规则

  • 若配对存在dummy=1,删除该配对的dummy=0行
  • 若配对无dummy=1,保留dummy=0行

原始数据集

a1 b1 1
a1 b1 0
a1 b2 0

a2 b3 1
a2 b3 0 
a2 b4 0

逻辑说明

以a1&b1配对为例,同时存在dummy=1和0,需保留1、删除0;a1&b2配对仅存在dummy=0,需保留该值。

期望处理后结果

a1 b1 1
a1 b2 0
a2 b3 1
a2 b4 0

R代码解决方案(适合新手)

步骤1:加载必要的包

用dplyr包做分组筛选,逻辑清晰易读:

# 未安装过dplyr的话先运行这行
# install.packages("dplyr")
library(dplyr)

步骤2:读取数据

假设数据是文本格式,直接读入R:

# 若数据存本地文件,替换成read.table("你的文件路径")
data <- read.table(text = "a1 b1 1
a1 b1 0
a1 b2 0
a2 b3 1
a2 b3 0 
a2 b4 0", header = FALSE, col.names = c("col1", "col2", "dummy"))

步骤3:按配对分组筛选

按col1和col2(即配对组合)分组,每组内自动判断筛选规则:

processed_data <- data %>%
  group_by(col1, col2) %>%
  filter(if(any(dummy == 1)) dummy == 1 else TRUE) %>%
  ungroup()

步骤4:查看结果

运行代码即可得到目标数据:

print(processed_data, row.names = FALSE)

输出结果:

col1 col2 dummy
  a1   b1     1
  a1   b2     0
  a2   b3     1
  a2   b4     0

内容的提问来源于stack exchange,提问作者Pang kalok

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.22 14:34:51