You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

R语言中从文件名向量提取指定字母数字模式的技术求助

R字符串提取解决方案(基于stringr包)

针对你提供的文件名向量,以下是高效的提取方法:

1. 提取数字间的L/R字母

使用str_extract结合正则表达式,精准匹配前后为数字的L或R:

library(stringr)

vec = c("Img_1_(set1)_2L4_s.ext", "Img_37_(set19)_2R4_s.ext",  "Img_187_(set94)_4L4_s.ext", "Img_77_(set39)_4R2_s.ext")

# 提取L/R字符
lr_result <- str_extract(vec, "(?<=\\d)[LR](?=\\d)")
# 结果:[1] "L" "R" "L" "R"

正则说明:(?<=\\d)是反向预查(确保前面是数字),[LR]匹配目标字母,(?=\\d)是正向预查(确保后面是数字)。

2. 提取set相关内容

含括号的版本

直接匹配括号内的set+数字组合:

set_with_bracket <- str_extract(vec, "\\(set\\d+\\)")
# 结果:[1] "(set1)"  "(set19)" "(set94)" "(set39)"

不含括号的版本

有两种简便方法:

  • 方法1:直接匹配无括号的set+数字
set_without_bracket <- str_extract(vec, "set\\d+")
  • 方法2:从含括号的结果中移除括号
set_without_bracket <- str_remove_all(set_with_bracket, "[\\(\\)]")

两种方法结果一致:[1] "set1" "set19" "set94" "set39"

关于你之前尝试的问题说明

你之前用的"(?<= \)_)[0-9]*"正则存在两个问题:

  1. 转义错误:\)需要写成\\)才能在R字符串中生效;
  2. 匹配目标错误:你要提取字母,但正则写的是[0-9]*(匹配数字),所以返回全NA。

内容的提问来源于stack exchange,提问作者5ant1

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.04 22:55:16