在BigQuery中提取特定匹配字符串'sc'后的内容是否可行?
在BigQuery中提取'sc'之后的目标内容
当然可以实现这个需求!你可以利用BigQuery的REGEXP_EXTRACT函数,结合贪婪模式的正则表达式精准捕获最后一次出现'sc'之后的内容。
具体SQL示例
SELECT REGEXP_EXTRACT( 'www.xxss.com?psct=T-EST2%20.coms&.com/u[sc\'sc(mascscin\', sc\'.c(scscossccnfiscg.scjs\']-/ci=1(sctitis)', r'.*sc(.*)$' ) AS extracted_content;
代码解释
REGEXP_EXTRACT:BigQuery中用于从字符串里提取匹配正则表达式部分内容的核心函数。- 正则表达式
r'.*sc(.*)$':.*:采用贪婪匹配逻辑,会尽可能匹配到最右侧的'sc',确保我们定位到的是最后一次出现的目标字符串。sc:指定你要匹配的触发字符串。(.*)$:捕获'sc'之后直到字符串结尾的所有内容,这正好对应你想要的titis)。
执行这段SQL后,返回的extracted_content字段值就是你期望的结果。
内容的提问来源于stack exchange,提问作者Irfan Candra
相关产品推荐
相关产品推荐

