R语言自定义函数生成dataframe时如何将输入df名加入新变量名
解决方案
- 覆盖问题的根源是原代码使用了
<<-全局赋值运算符,每次调用函数都会覆盖全局环境中已有的HL/HD/LL/LD变量;另外原代码存在笔误,Leavy是未定义对象,实际应改为Light。 - R完全支持动态生成变量名,这里提供两种常用实现方案:
方案1:直接生成带前缀的全局变量(符合要求的命名格式)
修改后的函数如下:
myfunction <- function(x){ # 获取传入数据框的名称 df_name <- deparse(substitute(x)) # 剔除Height为空的行(中间变量无需全局赋值) WithoutNA <- x[!is.na(x$Height),] # 按体重划分 Heavy <- WithoutNA[WithoutNA$Weight >= 150,] Light <- WithoutNA[WithoutNA$Weight < 150,] # 按毛色划分 HL <- Heavy[Heavy$FurColor=="light_Brown",] HD <- Heavy[Heavy$FurColor=="Dark_Brown",] LL <- Light[Light$FurColor=="light_Brown",] LD <- Light[Light$FurColor=="Dark_Brown",] # 动态赋值到全局环境,生成带数据框名称后缀的变量 assign(paste0("HL_", df_name), HL, envir = .GlobalEnv) assign(paste0("HD_", df_name), HD, envir = .GlobalEnv) assign(paste0("LL_", df_name), LL, envir = .GlobalEnv) assign(paste0("LD_", df_name), LD, envir = .GlobalEnv) }
注意:如果你的
Weight列是数值类型,判断条件不要给150加引号,否则会按字符串规则比较,得到错误的筛选结果。
调用方式和原有逻辑一致即可:
myfunction(Horse) myfunction(Pony)
运行后全局环境就会自动生成HL_Horse、HD_Horse等8个目标数据框。
方案2:更推荐的列表返回模式(避免污染全局环境)
如果不希望全局环境出现太多零散变量,可以让函数返回命名列表,使用更灵活:
myfunction <- function(x){ WithoutNA <- x[!is.na(x$Height),] Heavy <- WithoutNA[WithoutNA$Weight >= 150,] Light <- WithoutNA[WithoutNA$Weight < 150,] res <- list( HL = Heavy[Heavy$FurColor=="light_Brown",], HD = Heavy[Heavy$FurColor=="Dark_Brown",], LL = Light[Light$FurColor=="light_Brown",], LD = Light[Light$FurColor=="Dark_Brown",] ) return(res) }
调用方式:
horse_res <- myfunction(Horse) pony_res <- myfunction(Pony)
需要使用对应数据时直接取列表元素即可,比如horse_res$HL就是原来的HL_Horse。如果确实需要生成单独的全局变量,可以调用list2env(setNames(horse_res, paste0(names(horse_res), "_Horse")), envir = .GlobalEnv)手动批量生成。
内容的提问来源于stack exchange,提问作者Omniswitcher
相关产品推荐
相关产品推荐

