如何在dplyr中调用字段第n个偏移位置的对应值?
在dplyr语法中,你要的按行偏移引用可以通过lag()和lead()两个窗口函数实现:
- 调用第
i-n行的同列值(即上n行的值):使用lag(目标列名, n = 偏移量),默认n=1时就是你示例中YesorNo[i-1]的效果 - 调用第
i+n行的同列值(即下n行的值):使用lead(目标列名, n = 偏移量)
你示例中的for循环可以直接用dplyr语法替换,完整实现代码如下:
library(dplyr) stim <- c("a", "k", "y", "j", "t", "Stop", "f", "l", "b", "a", "c", "Stop") df <- data.frame(stim) df <- df %>% mutate( # 先给Stop行打初始N/A标记,其余行默认标记为yes YesorNo = ifelse(stim == "Stop", "N/A", "yes"), # 若下1行的YesorNo为N/A,则当前行替换为no YesorNo = ifelse(lead(YesorNo, n = 1) == "N/A", "no", YesorNo) )
运行上述代码得到的结果和你原for循环的输出完全一致。
如果要自定义偏移量n,直接修改lag()或lead()中的n参数即可。如果偏移后超出数据框的行范围,函数默认返回NA,你也可以通过default参数自定义超出范围时的返回值,示例如下:
# 取上3行的YesorNo值,超出范围的话默认返回"yes" lag(YesorNo, n = 3, default = "yes")
注意:lag()和lead()是基于数据框当前的行顺序计算的,使用前请确认数据的行顺序符合你的业务逻辑。
内容的提问来源于stack exchange,提问作者Kra.P
相关产品推荐
相关产品推荐

