R语言遍历目录Excel文件修改数据后回存原文件的求助
解决方案
首先确认你已安装openxlsx包,该包无需Java依赖,操作Excel更稳定,可直接通过以下代码实现需求:
# 加载所需包 library(openxlsx) # ID列表,删除原有末尾多余的逗号 IDList <- c("7c850aaa", "07311bbb") # 注意Windows路径的反斜杠需要转义,所有反斜杠都要写双份 MYFILEPATH <- "\\dcf.network\\data\\R\\Test Folder" # 获取所有Excel文件路径,仅筛选xlsx/xls后缀文件,避免读到其他格式文件报错 files <- list.files( path = MYFILEPATH, pattern = "\\.xlsx?$", # 匹配.xls和.xlsx后缀 full.names = TRUE, recursive = TRUE ) # 遍历处理每个文件,加入错误处理避免单个文件异常中断整个循环 for (i in seq_along(files)) { # 用tryCatch捕获处理单个文件时的异常 tryCatch({ # 读取文件 data <- read.xlsx(files[i]) # 校验必要列是否存在,不存在就跳过当前文件 if (!all(c("Account.ID", "Type") %in% colnames(data))) { message("文件:", files[i], " 缺少必要列,已跳过") next } # 修改匹配行的Type列值 data[data$Account.ID %in% IDList, "Type"] <- "REDACTED" # 将修改后的数据写回原文件,默认自动覆盖原有文件 write.xlsx(data, file = files[i]) message("文件:", files[i], " 处理完成") }, error = function(e) { # 输出错误信息,不中断循环 message("文件:", files[i], " 处理失败,错误信息:", e$message) }) }
注意事项
- 操作前请提前备份所有原始Excel文件,避免误操作导致数据丢失
- 如果你原本使用的是
xlsx包,将读写函数替换为read.xlsx2和write.xlsx2也可实现功能,但更推荐使用openxlsx避免Java环境相关报错 - 上述代码默认仅处理Excel的第一个工作表,如果你需要处理同一文件内的所有工作表,可额外新增工作表遍历逻辑
- 代码中加入了列名校验和错误捕获逻辑,单个文件处理失败不会影响其他文件的处理进度,输出的日志也可帮你快速定位异常文件
内容的提问来源于stack exchange,提问作者JeffWithpetersen
相关产品推荐
相关产品推荐

