pyparsing中如何区分作为OR运算符与IPv6地址组成部分的冒号
解决方案
核心思路是调整term的匹配优先级,让合法IPv6地址优先被识别为完整项,避免内部冒号被拆分作为OR运算符,同时不影响后续布尔逻辑的支持。
具体实现步骤
- 重构
term定义:将term拆分为三个匹配分支,按「IPv6地址 > IPv4地址 > 无冒号普通文本」的优先级排序,pyparsing会按顺序尝试匹配,只要高优先级模式命中就不会继续向下匹配。 - 保留原有逻辑:你原本绑定到
term的parseAction、infixNotation布尔表达式配置都不需要调整,IPv6地址会作为普通term的一种参与所有逻辑处理。
代码示例
from pyparsing import Word, alphanums, infixNotation, opAssoc # pyparsing 3.x及以上版本内置了标准IP地址匹配规则,无需自行实现 from pyparsing.common import ipv4_address, ipv6_address # 定义普通文本项:不包含冒号,避免和OR运算符冲突 plain_term = Word(alphanums + '.') # term按优先级匹配,保证IPv6内部冒号被归为地址部分 term = ipv6_address | ipv4_address | plain_term # 你原来的parseAction可以直接绑定到term,三类分支都会触发处理逻辑 term.addParseAction(你的自定义处理函数) # infixNotation配置完全保持原有逻辑不变 exp = infixNotation(term, [ (NOT, 1, opAssoc.RIGHT, Not_func), (AND, 2, opAssoc.LEFT, And_func), (':', 2, opAssoc.LEFT, Or_func), ])
适配低版本pyparsing
如果你使用的pyparsing版本低于3.x没有内置IP匹配规则,可以自行实现简易IPv6匹配规则:
ipv6_segment = Word(hexnums, min=1, max=4) ipv6_address = ( # 无压缩的完整IPv6 (ipv6_segment + (':' + ipv6_segment)*7) | # 支持::压缩格式的IPv6 (ipv6_segment + (':' + ipv6_segment)*0 + '::' + (':' + ipv6_segment)*0) )
效果验证
- 输入
2001:db8::1:8080:会被识别为单个完整IPv6 term,内部冒号不会被解析为OR运算符 - 输入
abc:def:不符合IPv6格式,会被解析为abc OR def,符合运算符逻辑
内容的提问来源于stack exchange,提问作者mimookies
相关产品推荐
相关产品推荐

