R语言按dataframe的n列唯一值筛选行生成独立数据框并导出
R 实现按n列唯一值拆分dataframe并导出的方案
基础R实现(无需额外安装包)
直接遍历n列的唯一值,逐次筛选并导出即可,无需提前将唯一值转为dataframe:
# 1. 提取n列的所有唯一值 unique_n <- unique(bbbbb$n) # 2. 遍历每个唯一值生成子数据框并导出 for (current_n in unique_n) { # 筛选n等于当前值的所有行 sub_data <- bbbbb[bbbbb$n == current_n, ] # 生成子数据框存入全局环境(不需要可以删掉这行) assign(paste0("n_", current_n, "_df"), sub_data, envir = .GlobalEnv) # 写入到本地文件,文件名带对应n值,这里用制表符分隔的txt格式,也可改成csv write.table(sub_data, file = paste0("n_value_", current_n, ".txt"), sep = "\t", row.names = FALSE, quote = FALSE) }
运行后会在工作目录生成对应每个n值的独立文件,同时全局环境里也会生成对应命名的子dataframe,比如n_2_df就是你示例中n=2的子数据框。
tidyverse生态实现(代码更简洁)
如果习惯用dplyr和purrr,可以用分组拆分的方式批量处理:
library(dplyr) library(purrr) # 按n列分组拆分,得到存储所有子数据框的命名列表 split_dfs <- bbbbb %>% group_split(n, .keep = TRUE) %>% setNames(nm = paste0("n_", map_chr(., ~as.character(unique(.x$n))))) # 批量写入本地文件 iwalk(split_dfs, ~write.table(.x, file = paste0(.y, ".tsv"), sep = "\t", row.names = FALSE, quote = FALSE)) # 把所有子数据框加载到全局环境(不需要可以删掉这行) list2env(split_dfs, envir = .GlobalEnv)
内容的提问来源于stack exchange,提问作者PesKchan
相关产品推荐
相关产品推荐

