如何合并两个Glycemie score变量并计算整体中位数?
计算两个血糖得分的中位数(合并变量)
以下是两种常用编程语言的实现方案,适配你1000条ID的数据集:
R语言实现
基础R方法
直接使用apply函数按行计算中位数,自动处理每行的两个观测值:
# 假设你的数据框名为df df$Glycemie_median <- apply(df[, c("Glycemie score 1", "Glycemie score 2")], 1, median, na.rm = TRUE)
参数na.rm = TRUE用于忽略可能存在的缺失值,若数据无缺失可省略。
tidyverse风格方法
如果习惯用tidyverse工具链,可用rowwise()按行操作:
library(tidyverse) df <- df %>% rowwise() %>% mutate(Glycemie_median = median(c(`Glycemie score 1`, `Glycemie score 2`), na.rm = TRUE)) %>% ungroup()
Python(pandas)实现
利用pandas的median方法高效计算每行中位数:
import pandas as pd # 假设你的数据框名为df df['Glycemie_median'] = df[['Glycemie score 1', 'Glycemie score 2']].median(axis=1, skipna=True)
axis=1指定按行计算,skipna=True用于跳过缺失值。
内容的提问来源于stack exchange,提问作者mumber1
相关产品推荐
相关产品推荐

