如何使用KQL从API调用URL中提取目标变量元素?
提取API URL中的目标字符串方案
方法一:路径分段筛选(灵活易调整)
先把URL按斜杠/拆成段落列表,再从后往前找符合特征的目标字符串:
- 第一步:拆分URL并过滤空元素(避免开头斜杠产生的空字符串)
示例Python代码:url = "/API/XXX/1111/XXX/XX/XXX/XXX/XXX/XXX/stringIwant/XXXX" segments = [seg for seg in url.split('/') if seg] - 第二步:从后遍历,按目标特征筛选(比如排除纯数字、固定占位符XXX/XXXX)
假设你的目标字符串既不是纯数字,也不是系统占位符,代码可以这么写:
你可以根据实际情况修改筛选规则,比如目标字符串包含特定关键词,直接加判断即可。placeholders = {'XXX', 'XXXX'} target_str = None # 从后往前找第一个符合条件的分段 for seg in reversed(segments): if not seg.isdigit() and seg not in placeholders: target_str = seg break print(target_str) # 输出 stringIwant
方法二:正则表达式匹配(适合规则明确的场景)
如果目标字符串的位置规则清晰(要么是最后一段,要么是倒数第二段,且末尾的干扰段是数字/固定占位符),可以用正则直接捕获:
示例Python代码:
import re # 正则规则:匹配末尾非占位符/非数字的分段,允许后面跟着一个占位符/数字段 pattern = r'/(?!XXX|XXXX|\d+)([^/]+)(?:/XXX|XXXX|\d+)?$' test_urls = [ "/API/XXX/1111/XXX/XX/XXX/XXX/XXX/XXX/stringIwant/XXXX", "/API/XXXX/1111/XXXX/xxx55566/StringIwant", "/API/XXXX/111/XXX/XXX/XXX/xxx123/zzz/xx34/StringIwant" ] for url in test_urls: match_result = re.search(pattern, url) if match_result: print(match_result.group(1))
运行后会输出:
stringIwant StringIwant StringIwant
如果有其他类型的干扰占位符,直接在正则里的XXX|XXXX部分补充即可。
内容的提问来源于stack exchange,提问作者Symon Turner
相关产品推荐
相关产品推荐

