Java中' '为何被编译为单引号?Unicode转义规则疑问
关于Java Unicode转义的异常现象疑问
我在研究Java Unicode转义时,意外发现一个有趣的异常现象。编写的代码如下:
static void main(String... args) { /* * \u0027 - 单引号 */ char e = \u0027\n\u0027; char f = '\''; System.out.println(e == f); // 输出:true }
查看编译后的代码,Java编译器将它们转换为相同的字符字面量:
char e = '\''; char f = '\'';
请问是什么转换规则导致变量e变成了单引号'而非换行符\n?
另外,我使用的是Windows 11系统上的Oracle JDK 19。
编辑:该问题似乎与Java编译器未遵循Java语言规范有关。
编辑:该问题似乎在Oracle JDK 19运行于JLS 18模式时出现。(表述可能不准确)
解答
Java的Unicode转义处理优先级是最高的——编译器会先扫描所有\uXXXX序列,将其替换为对应的Unicode字符,这个过程发生在注释、字符串字面量、换行符等任何语法解析之前。
按照规范,原代码中的char e = \u0027\n\u0027;经过Unicode转义替换后,\u0027会被替换为单引号',代码会变成:
char e = '\n';
此时变量e应该是换行符,和f的单引号比较应输出false,但你的实际结果和编译后代码都显示e被处理成了单引号,这显然不符合规范。
结合你提到的Oracle JDK 19及JLS 18模式的情况,这应该是特定版本编译器的实现异常:在该模式下,编译器可能错误地处理了转义后的字符序列,忽略了\n,最终将两个单引号之间的内容解析为空,形成了'\''的字符字面量。
内容的提问来源于stack exchange,提问作者Microtribute
相关产品推荐
相关产品推荐

