正则匹配报错:使用regex提取双反斜杠后文件名失败如何解决?
错误原因
- 正则语法错误:
*是量词,代表匹配前面的元素0次或多次,不能直接出现在正则开头或者零宽断言的开头,你写的(?<=*\\\\)里*前面没有任何匹配规则,所以触发了nothing to repeat报错。 - 正则逻辑错误:就算修正语法问题,Python标准库的
re不支持可变长度的后视断言,你原本的思路也无法直接实现提取需求。
正确实现方案
你要提取最后一个反斜杠后的内容,再把后缀的点换成下划线匹配预期结果,有两种简单可行的写法:
写法1:修正正则匹配
import re string = 'I:/Etrmtest/PZMALIo4/ETRM841_FX_Deals_Restructuring/FO_PRE\\abo_st_gas_dtd.csv' # 匹配字符串末尾所有非反斜杠的字符 pattern = r'[^\\]+$' res = re.findall(pattern, string)[0].replace('.', '_') print(res) # 输出:abo_st_gas_dtd_csv
写法2:不用正则,字符串分割效率更高
string = 'I:/Etrmtest/PZMALIo4/ETRM841_FX_Deals_Restructuring/FO_PRE\\abo_st_gas_dtd.csv' res = string.split('\\')[-1].replace('.', '_') print(res)
内容的提问来源于stack exchange,提问作者Mauro
相关产品推荐
相关产品推荐

