如何用Python正则表达式从配置文件提取不含注释的配置值?
解决配置文件提取值时排除注释的问题
嘿,我懂你现在的困扰——正则把注释也一起捞进来了对吧?咱们调整下正则表达式,就能精准提取到你要的配置值,彻底把后面的注释排除在外。
原代码的问题
你原来用的LISTEN=(.*)是贪婪匹配,它会把=之后直到行末的所有内容都抓进来,包括那个#开头的注释部分,所以才会拿到带注释的结果。
方案一:通用匹配(兼容有无注释/空格场景)
如果你的配置项后面可能带注释、可能不带,甚至=和值之间有空格,用这个正则就很合适:
import re with open('config.txt') as f: data = f.read() # 匹配配置值,自动忽略后面的注释和多余空格 listen_matches = re.findall(r'LISTEN\s*=(.*?)(?:\s*#|$)', data) # 去除值前后的冗余空格(比如值和=之间有空格的情况) listen = [val.strip() for val in listen_matches] print(listen) # 输出会是 ['192.168.180.1']
拆解下这个正则的逻辑:
LISTEN\s*=:匹配LISTEN,兼容任意数量的空格(支持LISTEN=和LISTEN =两种格式),再匹配=(.*?):非贪婪匹配,只抓取到第一个停止条件前的内容,不会贪多(?:\s*#|$):非捕获组,指定停止条件——要么是任意空格加#(注释开头),要么是行尾(无注释的情况)
方案二:精准匹配IP格式(针对LISTEN项)
因为LISTEN的值是IP地址,咱们可以直接匹配IP的格式,这样不管后面有没有注释,都能精准提取:
import re with open('config.txt') as f: data = f.read() listen = re.findall(r'LISTEN\s*=(\d+\.\d+\.\d+\.\d+)', data) print(listen) # 同样输出 ['192.168.180.1']
这个方法更严谨,不会误抓非IP内容,适合明确知道配置值格式的场景。
内容的提问来源于stack exchange,提问作者Arun
相关产品推荐
相关产品推荐

