Flex匹配首个END终止BEGIN...END块的正则问题求助
解决Flex中
begin...end块的非贪婪匹配问题 这问题我太熟悉了!你碰到的是Flex正则默认的贪婪匹配坑——Flex的正则表达式默认会尽可能匹配最长的符合规则的字符串,所以你的原正则"begin"[.\n]*"end"会从第一个begin一直抓到底部最后一个end,完全忽略中间的end分界。
要实现匹配到第一个end就终止的非贪婪效果,咱们得手动构造一个不会“跳过”end的正则(因为Flex本身不支持*?这种非贪婪量词)。直接上可行的写法:
"begin"([^e]|e[^n]|en[^d])*"end" { return ID_BLOCK; }
简单解释下这个正则的逻辑:
[^e]:匹配任何不是字符e的内容(包括换行符,刚好满足你需要匹配多行代码块的需求)e[^n]:匹配e后面不是n的情况,避免误判end的开头en[^d]:匹配en后面不是d的情况,确保只有完整的end才会触发匹配终止
这样写之后,Flex就会从begin开始逐字符检查,一旦遇到完整的end就立刻停止匹配,完美捕获单个独立的begin...end块。比如你给的示例:
begin /some code #1/ end /some code #2/ begin /some code #3/ end
修改后的正则会分别匹配到begin /*some code #1*/ end和begin /*some code #3*/ end两个独立块,中间的/*some code #2*/会被当作普通内容处理(如果你的规则里有其他匹配项的话)。
另外补充个小细节:如果你的代码块里可能出现类似send这种包含end子串的单词,这个正则也能正确区分,不会把send里的end当成块结束符,因为它只会匹配完整的end序列。
内容的提问来源于stack exchange,提问作者ldana
相关产品推荐
相关产品推荐

