Terraform不支持正则lookahead时如何提取TEMP与SUB间的字符
Terraform 不支持正则前瞻时提取固定格式字符串指定片段的方案
报错原因
Terraform 内置正则能力基于 RE2 引擎实现,不支持 Perl 兼容正则(PCRE)的零宽断言语法,包括之前使用的前瞻(?=)、后顾、负向断言等特性都会直接抛出语法错误,没有配置项可以开启该支持。
可行实现方案
方案1:使用捕获组匹配(通用性最强,推荐)
不需要依赖前瞻语法,直接通过小括号()标记要提取的目标片段作为捕获组,用regex函数匹配后直接取捕获组结果即可,逻辑比前瞻更清晰,也不容易出现误匹配。
针对JMJ-TEMP-{word}-SUB-C类格式,正则可以写为:
JMJ-TEMP-([A-Za-z0-9]+)-SUB-
对应Terraform代码示例:
locals { input_str1 = "JMJ-TEMP-DB-SUB-C" input_str2 = "JMJ-TEMP-DB-SUB-A" # 取第一个捕获组的匹配结果,即TEMP和SUB之间的目标词 target1 = regex("JMJ-TEMP-([A-Za-z0-9]+)-SUB-", local.input_str1)[0] # 返回DB target2 = regex("JMJ-TEMP-([A-Za-z0-9]+)-SUB-", local.input_str2)[0] # 返回DB }
如果目标词可能包含特殊字符,可以把捕获组规则调整为非贪婪匹配(.+?),适配更灵活的内容:
JMJ-TEMP-(.+?)-SUB-
- 注意:如果输入字符串不符合约定格式,
regex函数会直接抛出错误,适合输入格式有明确约束的场景。
方案2:按固定分隔符拆分(适合结构完全固定的场景)
如果字符串始终以短横线-作为固定分隔符,结构完全符合[前缀]-TEMP-[目标词]-SUB-[后缀]的规则,甚至不需要用正则,直接用split函数拆分字符串后按下标取值即可,性能更高、逻辑更直白。
示例代码:
locals { input_str = "JMJ-TEMP-DB-SUB-A" str_parts = split("-", local.input_str) # 拆分后列表下标从0开始,依次为JMJ、TEMP、目标词、SUB、后缀,目标词对应下标2 target = local.str_parts[2] # 返回DB }
- 注意:该方案依赖字符串分段结构完全固定,如果前缀、中间段的分段数量发生变化,下标取值会出错,适合格式100%固定的场景。
补充说明
如果有大量PCRE正则的使用习惯,在Terraform里写正则时需要注意:除了零宽断言,反向引用、递归匹配、条件匹配等PCRE高级特性RE2引擎也都不支持,优先用捕获组、字符集、贪婪/非贪婪匹配的基础组合实现需求即可。
内容的提问来源于stack exchange,提问作者Myeongjang JO
相关产品推荐
相关产品推荐

