You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用mitools和survey包计算NSCH数据统计量时出现NA值

NSCH多重插补数据集统计量计算返回NA问题及可复现示例建议

背景与问题现象

首次在R中处理NSCH数据,已完成数据导入、预处理及调查设计创建,流程运行正常。但计算自定义变量统计量时返回NA值,示例变量(如sc_age_years)可正常输出结果。

示例变量正常运行代码与结果

# 计算连续变量的均值(整体及分组)
MIcombine( with( nsch_design , svymean( ~ sc_age_years ) ) )

运行结果:

results
<dbl>
se
<dbl>
sc_age_years    8.839863    0.04435024

自定义变量计算返回NA的代码与结果

数值型变量ace5计算均值

# 我的代码
MIcombine( with( nsch_design , svymean( ~ ace5 ) ) )

返回结果:

results
<dbl>
se
<dbl>
ace5    NA  NA      

转换为因子变量后计算调查总数

nsch_design <-
    update(
        nsch_design ,
        ace5f = factor(
            ifelse(ace5 == 1, "Yes", ifelse(ace5 == 2, "No", NA)),
            levels = c("Yes", "No")
        )
    )

MIcombine( with( nsch_design , svytotal( ~ ace5f ) ) )

返回结果:

results
<dbl>
se
<dbl>
ace5fYes    NA  NaN     
ace5fNo NA  NaN 

注:其他数值型变量(如cavities)计算时也出现类似NA值。

疑问

  1. 为何自定义变量计算统计量会返回NA?
  2. 如何生成大型复杂多重插补数据集的最小可复现示例?

内容的提问来源于stack exchange,提问作者Blair Burnette

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.16 13:24:56