You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用R提取数据框中仅含2个发布者的行及关联字段?

解决方案(使用dplyr)

你可以通过统计Publisher字段里的分隔符数量,精准筛选出仅包含2个发布者的组合,用dplyr结合字符串处理函数就能实现:

library(dplyr)
library(stringr)

# 假设你的数据框名为df
filtered_df <- df %>%
  # 统计每个Publisher字符串中的逗号数量,2个发布者对应1个逗号
  mutate(pub_count = str_count(Publisher, ",")) %>%
  # 筛选出逗号数为1的行(即恰好2个发布者的组合)
  filter(pub_count == 1) %>%
  # 可选:移除用于计算的中间列
  select(-pub_count)

更严谨的备选方案

如果担心发布者名称里可能包含逗号(你的示例里没有这种情况),可以用分割字符串后计数的方式,准确性更高:

filtered_df <- df %>%
  mutate(pub_count = str_split(Publisher, ", ") %>% map_int(length)) %>%
  filter(pub_count == 2) %>%
  select(-pub_count)

结果说明

运行上述代码后,filtered_df会直接输出你预期的结果:仅保留含2个发布者的组合,以及对应的month_grp字段值。比如原数据里如果有"Amazon, CBS, CW"这类3个发布者的组合,会被自动过滤掉。


内容的提问来源于stack exchange,提问作者Dinho

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.10 07:25:19