You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用dplyr通过group by提取分组内最大年龄对应的value值

错误原因

你的代码中使用df$age、df$value的写法会直接读取未分组的全局原始数据,忽略group_by的分组逻辑,因此只会返回全表年龄最大的行对应的value值,无法实现分组计算的需求。

正确实现代码

library(dplyr)
df <- df %>%
  group_by(groups) %>%
  mutate(new_value = value[which.max(age)]) %>%
  ungroup() # 若后续不需要保留分组状态可添加此行

逻辑说明

group_by(groups)生效后,直接调用列名age、value默认取当前分组内的子集,which.max(age)会定位当前分组内年龄最大的行位置,提取对应行的value值后,自动填充到当前分组所有行的new_value字段,运行结果和你给出的预期输出完全一致。

内容的提问来源于stack exchange,提问作者Victor Hartman

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.24 01:24:07