Matlab正则表达式:含忽略字符的后向查找提取索引值
文件名index编号提取的正则解决方案
问题背景
需要从混合文件名列表中筛选包含fileType和deck-0001的文件,并提取index-后的数字编号(如示例中的0005),其中fileType与deck-0001之间存在可变字符。
问题分析
你之前尝试的正则表达式(?<=fileType.*deck-0001_index-)\d+无效,原因是Matlab的正则引擎不支持可变长度的后行断言(.*属于可变长度匹配,无法放在后行断言的括号内)。
可行方案
方案1:分组捕获(推荐)
直接通过正则分组捕获目标数字,无需依赖后行断言,兼容性更强:
testString = 'fileType-ignored_123456_deck-0001_index-0005.ext'; filePattern = 'fileType.*deck-0001_index-(\d+)'; matches = regexp(testString, filePattern, 'tokens', 'once'); if ~isempty(matches) fileIndex = str2double(matches{1}); % 结果为5(若需保留前导零,可直接取字符串matches{1}) end
- 表达式说明:
fileType.*deck-0001_index-匹配前缀部分,(\d+)将目标数字捕获为分组,通过tokens参数提取分组内容。
方案2:分步处理(更直观)
先筛选符合条件的文件名,再单独提取index编号:
testString = 'fileType-ignored_123456_deck-0001_index-0005.ext'; % 先判断文件名是否包含指定标识 if contains(testString, {'fileType', 'deck-0001'}) idxPattern = 'index-(\d+)'; matches = regexp(testString, idxPattern, 'tokens', 'once'); fileIndex = str2double(matches{1}); end
内容的提问来源于stack exchange,提问作者mtourtelot
相关产品推荐
相关产品推荐

