Stata转R代码时case_when搭配!is.na运行报错该如何解决
解决方案
你不需要拆分多次mutate调用case_when,直接在单次mutate中定义所有判断规则即可,case_when本身支持按顺序匹配多个条件,无需先初始化空列再逐次修改。
等价R代码(和原Stata逻辑完全一致)
# 加载dplyr包,如果你已经加载可以跳过这行 library(dplyr) pemg <- pemg %>% mutate(aposentadofam = case_when( proprendaposent > 0 & !is.na(proprendaposent) ~ 1, proprendaposent == 0 | is.na(proprendaposent) ~ 0 ))
你也可以用更简洁的写法实现相同逻辑:
pemg <- pemg %>% mutate(aposentadofam = as.integer(proprendaposent > 0 & !is.na(proprendaposent)))
逻辑判断为TRUE时会转成整数1,其余所有情况(值为0、值为NA)都会转成整数0,和你原Stata代码效果完全相同。
报错原因
你原来的写法报错是因为多轮重复调用case_when覆盖同一列的写法不符合函数设计逻辑,低版本dplyr对这种场景的语法解析会出错,误将条件表达式识别为公式对象,才会弹出你看到的报错提示。
内容的提问来源于stack exchange,提问作者Igor Mendonça
相关产品推荐
相关产品推荐

