如何用R语言的stargazer创建含子集组的并排汇总统计表?
用stargazer并排展示多子集汇总统计的简便方法
你可以直接给stargazer()传入多个数据框的列表,它会自动计算并并排展示每个子集的汇总统计,不用像合并模型那样复杂。具体操作步骤如下:
1. 拆分数据集
先把全样本和各个子集单独提取出来:
# 替换成你的数据集和子集筛选条件 full_data <- your_dataset commuter_subset <- subset(full_data, commute_status == "commuter") non_commuter_subset <- subset(full_data, commute_status == "non-commuter")
2. 调用stargazer生成并排汇总表
直接把拆分好的数据框放进列表里传给stargazer,同时指定要展示的统计量、列标签等:
stargazer( list(full_data, commuter_subset, non_commuter_subset), type = "text", # 根据需求换成"latex"或"html" title = "全样本与通勤群体汇总统计对比", summary.stat = c("n", "mean", "sd"), # 指定只展示样本量、均值、标准差 column.labels = c("全样本", "通勤者", "非通勤者"), # 给每列加标签 omit.summary.stat = c("min", "p25", "median", "p75", "max"), # 去掉不需要的统计量 digits = 2 # 控制小数位数 )
额外技巧
- 如果部分变量在子集里有缺失值,stargazer会自动标记
NA,你也可以提前用na.omit()清理数据; - 要是需要自定义统计量(比如中位数、四分位数),直接在
summary.stat里添加对应参数即可; - 确保你的stargazer是最新版本,旧版本对多数据框列表的支持可能有问题,用
update.packages("stargazer")更新。
内容的提问来源于stack exchange,提问作者Ricardo Gomez
相关产品推荐
相关产品推荐

