0xe+foo是如何解析的?为何会被识别为完整pp-number预处理数字
你漏看了规则中sign的定义,C/C++标准里明确规定规则中的sign就是指代+、-两个字符,这是+会被纳入pp-number的核心原因。
我们一步步拆解0xe+foo的解析逻辑:
- 首先解析到
0xe时,这已经是一个合法的pp-number - 此时下一个字符是
+,刚好匹配规则里的pp-number e sign条目,+作为sign被直接纳入当前pp-number的范围,不会被单独拆分为加法运算符 - 后续的
foo每个字符都属于identifier-nondigit(标识符非数字字符),匹配pp-number identifier-nondigit规则,会被继续吞入当前pp-number - 按照预处理阶段的最长匹配原则,所有连续符合pp-number规则的字符都会被归入同一个记号,最终整个
0xe+foo就被识别为一个完整的pp-number
你提到的x+++++y的解析逻辑和这个场景本质不同:x是标识符,标识符的合法组成字符只有字母、数字、下划线,+不属于标识符的合法字符,所以解析到+时必然会截断前面的标识符,单独处理运算符。而运算符的最长匹配规则下,+++++会优先拆分为++、++、+三个记号,最终得到x ++ ++ + y的结果。
补充说明:预处理阶段的pp-number规则设计得非常宽松,只负责拆分记号,不校验数字的合法性,所以哪怕0xe+foo显然不是一个合法的数值常量,预处理阶段也会先把它当做单个pp-number处理,合法性报错会在后续编译阶段抛出。
内容的提问来源于stack exchange,提问作者Avva
相关产品推荐
相关产品推荐

