使用dplyr::mutate处理含NA的列除法:自定义NA保留规则
解决方案
先确认你的示例数据:
a = c("x","y","z") b = c(1,2,NA) c = c(4,NA,6) c_b = c(4,NA,6) df=data.frame(a,b,c,c_b)
要实现你指定的c_b计算规则,推荐用dplyr::case_when来清晰定义分支逻辑,代码如下:
library(dplyr) df <- df %>% mutate(c_b = case_when( is.na(c) ~ NA_real_, # 分子c为NA时,保留NA is.na(b) ~ c, # 分母b为NA时,直接取c的数值 TRUE ~ c / b # 其他情况执行c/b运算 ))
运行后得到的结果符合预期:
a b c c_b 1 x 1 4 4.0 2 y 2 NA NA 3 z NA 6 6.0
如果偏好更简洁的写法,也可以用嵌套ifelse实现相同逻辑:
df <- df %>% mutate(c_b = ifelse(is.na(c), NA_real_, ifelse(is.na(b), c, c/b)))
内容的提问来源于stack exchange,提问作者ip2018
相关产品推荐
相关产品推荐

