R数据框按公园分组生成月份序号(Month id)列的实现求助
实现方案
方法1:tidyverse 实现(推荐,语法直观)
首先加载依赖包:
library(dplyr)
执行计算:
# 假设你的数据框名为 df df <- df %>% # 按公园分组独立计算序号 group_by(Park) %>% # dense_rank 保证相同月份序号一致,不同月份按时间顺序连续编号,sprintf 补前导零为两位格式 mutate(Month_id = sprintf("%02d", dense_rank(Month))) %>% # 取消分组 ungroup()
方法2:base R 实现(无需额外安装包)
df$Month_id <- ave( as.numeric(df$Month), df$Park, FUN = function(x) sprintf("%02d", match(x, sort(unique(x)))) )
逻辑说明
两种方法都完全匹配你的需求:
- 按Park分组独立计算,不同公园的序号互不干扰
- 相同公园内相同月份的行序号完全一致,不同月份按时间先后依次编号,和月份是否连续无关
- 输出为两位带前导零的格式,和你给出的预期效果完全匹配
内容的提问来源于stack exchange,提问作者Gab_Laj
相关产品推荐
相关产品推荐

