如何使用R将文件夹中的文件名导出为tibble/data frame
用纯R脚本提取PNG文件名并整理为整洁tibble
步骤1:加载所需工具包
直接用tidyverse套件,它整合了处理tibble、字符串和数据整理的所有必要工具:
library(tidyverse)
步骤2:提取目标文件夹中的PNG文件名
用list.files()函数精准获取目标文件夹里的所有PNG文件名(仅保留文件名,不含完整路径):
# 替换为你的PNG文件实际存放路径 png_folder <- "your/png/files/directory" png_filenames <- list.files( path = png_folder, pattern = "\\.png$", # 匹配PNG后缀 full.names = FALSE, # 只返回文件名,不包含路径 ignore.case = TRUE # 兼容.PNG/.png等大小写格式 )
步骤3:将文件名转为tibble格式
直接把文件名向量转换为tibble:
png_tibble <- tibble(filename = png_filenames)
步骤4:拆分文件名中的元数据
先移除文件名末尾的.png后缀,再按下划线拆分出预设的元数据字段:
tidy_png_data <- png_tibble %>% # 移除.png后缀 mutate(filename_no_ext = str_remove(filename, "\\.png$")) %>% # 按下划线拆分为指定字段 separate( col = filename_no_ext, into = c("patientId", "dateOfBirth", "sex", "modality", "date", "time"), sep = "_", remove = FALSE # 可选:保留原文件名字段用于核对 )
验证与使用
运行完成后,tidy_png_data就是包含所有元数据的整洁tibble,可直接用于后续分析。执行head(tidy_png_data)即可查看前几行数据,验证拆分是否准确。
内容的提问来源于stack exchange,提问作者Mark
相关产品推荐
相关产品推荐

