You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言如何按公司分组统计频次并合并对应产品及RegNo信息

R语言实现公司维度数据分组汇总方案

场景说明

现有存储多家公司及其对应产品注册信息的数据框,需完成按公司维度的汇总处理:

  • 原始数据结构参考:
    原始Dataframe,图1
  • 汇总后目标数据框需按COMPANY字段排序,效果参考:
    目标数据框,图2
  • 核心处理要求:
    • 统计每个公司(COMPANY字段)的出现频次,对应目标图绿色标注区域
    • 按公司分组,将旗下所有产品名称汇总到新列,对应目标图红色标注区域
    • 追加要求:汇总的产品名称后需附带对应RegNo注册编号字段内容,效果参考:
      追加需求示例

实现方案

采用dplyr包实现分组汇总逻辑,代码可直接复用:

  1. 先加载依赖(未安装请先运行install.packages("dplyr")完成安装)
library(dplyr)
  1. 运行核心处理逻辑
# 假设原始数据框变量名为raw_df,可根据实际情况替换
result <- raw_df %>%
  # 第一步:拼接单个产品和对应注册号,格式可按需调整
  mutate(product_info = paste0(PRODUCT, "(RegNo:", RegNo, ")")) %>%
  # 按公司字段分组
  group_by(COMPANY) %>%
  # 分组计算统计值
  summarise(
    COUNT = n(), # 计算公司出现频次
    ALL_PRODUCT = paste(product_info, collapse = "、") # 拼接同公司所有带注册号的产品信息,分隔符可自定义
  ) %>%
  # 按COMPANY字段排序
  arrange(COMPANY)

参数调整说明

  • 产品与注册号的拼接格式:修改mutate步骤中paste0的拼接规则即可,比如调整括号样式、增减连接符
  • 产品列表的分隔符:修改paste函数中collapse的参数值,可替换为逗号、分号等任意分隔符
  • 如果需要输出不带注册号的基础版本汇总,将拼接步骤的product_info替换为原始PRODUCT字段即可

内容的提问来源于stack exchange,提问作者FrozenHeart

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.26 21:57:23