如何在Athena中提取字符最后一次出现前的字符串?
在Athena中提取字符最后一次出现前的字符串
Athena基于Presto SQL,这里提供两种实用方法实现需求:
方法一:正则表达式替换
直接匹配最后一个分隔符及其后面的内容,替换为空即可,代码简洁直观:
SELECT regexp_replace('ABC-CAD-DAB', '-[^-]*$', '') AS result;
执行后结果就是ABC-CAD。如果你的分隔符不是-,只需要把表达式里的-换成对应字符就行。
方法二:结合反转、位置查找与截取
和你之前用instr+substr的思路类似,通过反转字符串把“找最后一次出现”转换成“找第一次出现”:
SELECT substr( 'ABC-CAD-DAB', 1, length('ABC-CAD-DAB') - instr(reverse('ABC-CAD-DAB'), '-') ) AS result;
逻辑拆解:
reverse('ABC-CAD-DAB')将字符串反转成BAD-DAC-CBAinstr(..., '-')找到反转后第一个-的位置(这里是4)- 用原字符串长度减去这个位置,得到需要截取的长度,再用
substr提取前半部分
内容的提问来源于stack exchange,提问作者Shankar Panda
相关产品推荐
相关产品推荐

