Matlab中regexp()函数在Linux与Windows平台行为不一致问题
差异产生原因
该跨平台行为不一致的核心原因是Windows系统的路径分隔符\属于正则表达式的专用转义字符,直接将拼接filesep得到的字符串作为正则匹配模式传入时,Windows平台下生成的模式不符合预期,导致匹配失败:
- Linux环境下
filesep返回正斜杠/,不属于正则特殊字符,最终生成的匹配模式为/test/,可以被正则引擎正常识别,匹配到路径中的对应片段完成拆分,输出结果符合预期。 - Windows环境下
filesep返回反斜杠\,最终生成的匹配模式字符串为\test\。正则引擎解析该模式时,会将开头的\t识别为制表符的转义序列,而非字面意义的「反斜杠+字母t」,自然无法匹配到路径中的\test\片段,匹配失败后直接返回包裹原字符串的1×1元胞数组,和观测到的输出完全一致。
可行修复方案
两种写法可以彻底规避该跨平台问题:
- 仍使用
regexp时,先用regexptranslate对分隔符做转义处理,保证所有特殊字符按字面量匹配:test_string = '<some_path>/tool/test/unit_test'; seperator = sprintf('%stest%s',filesep,filesep); % 转义所有正则特殊字符 match_pattern = regexptranslate('escape', seperator); regexp(test_string, match_pattern, 'split') - 固定分隔符拆分场景不需要使用正则,直接调用
split函数即可,完全不会触发正则转义问题,写法更简洁:split(test_string, seperator)
内容的提问来源于stack exchange,提问作者Zeitproblem
相关产品推荐
相关产品推荐

