R语言合并xlsx同名工作表 跳过缺表文件并新增文件名列
R批量合并Excel指定工作表实现方案
你之前的检测逻辑无法新增来源列,本质是读取成功后没有给对应数据框新增文件名字段的操作,同时存在中文引号笔误、行绑定兼容性差的问题。以下代码可直接实现需求:自动跳过无目标工作表的文件、合并所有存在的目标工作表、自动添加来源文件名列,全程沿用你之前使用的readxl包读取逻辑:
# 加载依赖包 library(readxl) library(dplyr) # 配置基础参数 target_sheet <- "sheet_1" # 替换为你要匹配的目标工作表名,注意大小写 all_files <- list.files(pattern = "*.xlsx") # 批量遍历读取 merged_list <- lapply(all_files, function(current_file){ # 提取当前文件内所有工作表名称 file_all_sheets <- excel_sheets(current_file) # 判断目标工作表是否存在 if(target_sheet %in% file_all_sheets){ # 读取目标工作表 dt <- read_excel(current_file, sheet = target_sheet) # 新增来源文件名列 dt$source_file <- current_file return(dt) } # 无目标工作表时返回NULL,后续合并自动跳过 return(NULL) }) # 合并所有有效数据 final_data <- bind_rows(merged_list)
注意事项
- 写代码时所有引号、括号都要用英文半角格式,你之前写的检测逻辑里出现了中文右引号,会直接导致代码运行报错。
- 工作表名默认大小写完全匹配,比如要找
sheet_1就不能写成Sheet_1,否则会判定为工作表不存在;如果需要不区分大小写匹配,可以把判断逻辑调整为先把所有工作表名转成统一大小写再比对。 - 用
dplyr::bind_rows做行绑定,比基础的do.call(rbind)兼容性更好,可以自动处理不同文件中列顺序不一致、部分列缺失的情况,不会因为列结构微差报错;如果不想加载dplyr,也可以换回基础rbind,但需要保证所有目标工作表的列名、列类型完全一致。 - 如果需要查看哪些文件被跳过,可以在判断分支里加一行打印提示,运行时就会在控制台输出被跳过的文件名,示例代码:
if(!(target_sheet %in% file_all_sheets)) message(paste0("已跳过:", current_file, "(未找到目标工作表)"))
内容的提问来源于stack exchange,提问作者ZlatanV
相关产品推荐
相关产品推荐

