如何在ANTLR语法中强制非终结符重复匹配同一产生式?
ANTLR实现同单词重复序列匹配的方案
现有ANTLR语法能匹配dog、cat、bird任意组合的序列,但需求是仅匹配同一单词的重复序列(比如dog dog dog、cat cat),且不能在program规则里逐个列举word的所有可选产生式。ANTLR没有正则式的反向引用,但可以通过以下两种方案实现:
方案1:语义谓词校验
利用语义谓词结合上下文记录的第一个单词文本,判断后续单词是否一致。修改后的语法示例:
program : first=word (WS word {_input.LT(1).getText().equals($first.getText())})+ EOF ; word : 'dog' | 'cat' | 'bird' ; WS : ' ';
解析时先匹配第一个word并保存其文本,后续每个word都要满足语义谓词的判断——和第一个单词文本完全一致,才会被允许匹配。
方案2:语法动作直接校验
在解析过程中通过动作代码记录目标单词,对后续匹配的单词做合法性检查(以Java目标语言为例):
program : first=word {String targetWord = $first.getText();} (WS word { if(!_input.LT(1).getText().equals(targetWord)) { throw new IllegalArgumentException("必须匹配与第一个单词相同的内容:" + targetWord); } })+ EOF ; word : 'dog' | 'cat' | 'bird' ; WS : ' ';
这种方式和语义谓词思路一致,只是直接在动作代码里抛出异常,终止不符合要求的匹配。
额外说明
- 上述示例基于Java目标语言,不同目标语言(如Python、C#)的语法动作写法会略有差异,但核心逻辑相同。
- 两种方案都不需要修改
program规则来适配word的可选值扩展,后续新增word的选项时,program规则无需变动,完全符合需求。
内容的提问来源于stack exchange,提问作者Yevgeniy P
相关产品推荐
相关产品推荐

