You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言按ID列分组拼接多列行内容运行报错该如何解决?

原代码错误原因
  • 变量名不匹配:aggregate函数中传入的数据集参数写的是df,但你实际加载的数据集变量名为diagnoses,R找不到df对象直接触发报错
  • 计算结果未赋值:你执行了聚合拼接操作,但没有把返回的结果赋值给变量,原diagnoses数据集没有被修改,最终导出的还是原始未处理数据
  • 未保留Name列:你仅按ID分组聚合,Name列既不在分组规则里也不在聚合字段中,最终结果会丢失该列,根据你的数据特性(同ID对应唯一Name),把Name加入分组规则即可保留
修复后代码(和你原写法兼容的基础R版本)
library(readxl)
library(openxlsx) # 你调用write.xlsx需要先加载这个包

# 读取数据
diagnoses <- read_xlsx("excel file.xlsx")
diagnoses <- diagnoses[,c("ID","Name","Diagnosis","Medicine")]

# 按ID+Name分组拼接,结果赋值给新变量
diagnoses_agg <- aggregate(cbind(Diagnosis, Medicine) ~ ID + Name, data = diagnoses, paste, collapse = '|')

# 导出处理后的结果
write.xlsx(diagnoses_agg, "Diagnoses.xlsx")
可选:tidyverse(dplyr)版本(更易读易维护)
library(readxl)
library(openxlsx)
library(dplyr)

diagnoses <- read_xlsx("excel file.xlsx") %>%
  group_by(ID, Name) %>%
  summarise(
    Diagnosis = paste(Diagnosis, collapse = "|"),
    Medicine = paste(Medicine, collapse = "|"),
    .groups = "drop"
  )

write.xlsx(diagnoses, "Diagnoses.xlsx")

内容的提问来源于stack exchange,提问作者paru80

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.02 07:57:03