在R语言中将数据行中的0值替换为该行均值的问题求助
解决方法
你的代码问题在于计算了SalaryInUSD整列的均值,而非每行的均值。要实现将每行中值为0.00的元素替换为该行均值,可按以下方式处理:
通用处理方案(针对数据框所有数值列)
先定义单行处理函数,再逐行应用:
# 定义函数:将单行中的0替换为该行非0元素的均值 replace_zero_with_row_mean <- function(row) { # 计算该行非0值的均值,忽略NA row_mean <- mean(row[row != 0], na.rm = TRUE) # 替换0值 row[row == 0] <- row_mean return(row) } # 筛选数据框中的数值列,逐行应用函数并替换原数据 numeric_cols <- sapply(ms, is.numeric) ms[numeric_cols] <- t(apply(ms[numeric_cols], 1, replace_zero_with_row_mean))
仅处理指定列的方案
如果只需要处理特定列(比如SalaryInUSD和其他目标列),可以直接指定列名:
target_cols <- c("SalaryInUSD", "OtherCol1", "OtherCol2") ms[target_cols] <- t(apply(ms[target_cols], 1, replace_zero_with_row_mean))
关键说明
apply(..., 1, ...)用于按行遍历数据,t()转置结果以匹配原数据框的行结构na.rm = TRUE确保计算均值时忽略缺失值,避免出现NA结果- 函数中优先计算该行非0元素的均值,避免0值拉低均值结果
内容的提问来源于stack exchange,提问作者Alex
相关产品推荐
相关产品推荐

