You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用tbl_svysummary为行百分比添加对应行置信区间?

解决tbl_svysummary行百分比对应置信区间的问题

要让置信区间匹配行百分比,需要自定义统计量计算逻辑——默认add_ci()计算的是列百分比的置信区间,无法直接适配行百分比需求。以下是具体修改方案:

步骤1:自定义行百分比及置信区间的统计函数

先定义一个函数,借助survey包的svyciprop()计算行比例的置信区间,再转换为百分比格式:

# 加载所需包
library(gtsummary)
library(survey)

# 自定义统计函数:生成行百分比+对应置信区间
row_pct_ci <- function(data, variable, by, weights, ...) {
  # 创建调查设计对象(替换weights为你的权重列名)
  svy_design <- svydesign(ids = ~1, weights = as.formula(paste0("~", weights)), data = data)
  
  # 计算行维度的比例置信区间(by为分组变量,variable为行变量)
  prop_ci <- svyciprop(
    formula = as.formula(paste0("~", by, " | ", variable)),
    design = svy_design,
    method = "logit"  # 可根据数据特性更换为"likelihood"或"asin"等
  )
  
  # 转换为百分比格式,保留1位小数
  pct <- prop_ci * 100
  ci <- confint(prop_ci) * 100
  
  # 整理成「百分比 (CI下限, CI上限)」的格式
  paste0(
    sprintf("%.1f", pct),
    " (", sprintf("%.1f", ci[, 1]), ", ", sprintf("%.1f", ci[, 2]), ")"
  )
}

步骤2:在tbl_svysummary中应用自定义统计量

修改原代码,指定statistic参数调用自定义函数,替代默认的统计量计算逻辑:

data %>%
  tbl_svysummary(
    by = "cig",
    include = ses,
    percents = "row",
    # 为分类变量指定自定义的行百分比+置信区间统计量
    statistic = list(all_categorical() ~ "{row_pct_ci(., variable = 'ses', by = 'cig', weights = 'your_weight_column')}")
  )

关键注意事项

  • 替换代码中的your_weight_column为你数据中实际的权重列名;
  • 若需调整小数位数,修改sprintf()中的%.1f即可(比如%.2f保留两位小数);
  • svyciprop()的method参数可根据数据分布特性选择,logit是通用且稳健的默认选项。

内容的提问来源于stack exchange,提问作者Hope Muller-Tabs

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.03 21:50:38