使用dplyr分组计算置信区间时summarize函数报错求助
问题解决:dplyr summarize计算置信区间报错
错误原因分析
n(autonomous)用法错误:n()函数无需传入参数,它默认返回当前分组的观测总数。若要统计autonomous列的非缺失值数量,可改用sum(!is.na(autonomous))。- 变量名拼写错误:代码中
mean_autonomou少了末尾的s,应修正为mean_autonomous。
修正后的代码
auto_means <- motivation %>% group_by(yeargroup) %>% summarize(mean_autonomous = mean(autonomous, na.rm = TRUE), # 添加na.rm=T处理缺失值,可选但推荐 sd_autonomous = sd(autonomous, na.rm = TRUE), N_autonomous = n(), # 直接获取分组样本量 se = sd_autonomous / sqrt(N_autonomous), upper_limit = mean_autonomous + se, lower_limit = mean_autonomous - se )
补充说明
如果autonomous列存在缺失值,建议在mean()和sd()中添加na.rm = TRUE参数,避免统计结果返回NA。
内容的提问来源于stack exchange,提问作者manateemanatee77
相关产品推荐
相关产品推荐

