R语言中列排名遇并列值不跳过后续序号的实现方法咨询
解决方法
你需要的这种并列后不跳过后续序号的排名属于密集排名,可以通过以下两种方式实现:
方法1:使用dplyr内置的dense_rank()函数(更推荐)
直接替换原有排名逻辑即可,代码如下:
C <- df %>% group_by(A) %>% mutate(C = dense_rank(-B)) %>% ungroup()
运行后得到的结果符合需求:
A B C group1 325 1 group1 325 1 group1 123 2
方法2:调整base R rank()函数的ties.method参数
将原参数ties.method = "min"修改为ties.method = "dense"即可:
C <- df %>% group_by(A) %>% mutate(C = rank(-B, ties.method = "dense")) %>% ungroup()
两种方法效果完全一致。你之前使用的ties.method = "min"会将并列组的排名设为该组的最小可用序号,所以后续排名会跳过并列占用的位置;而dense规则下排名序号会连续生成,不会跳号。
内容的提问来源于stack exchange,提问作者Agata
相关产品推荐
相关产品推荐

