如何查找单元格字符末次出现位置及提取URL末尾页面名称
URL末尾页面名称提取方案
无末尾斜杠的常规URL提取
你提到的「先定位最后一个"/"的位置,再截取后半段」的思路完全可行,不同工具的实现方式如下:
- 电子表格(Excel/WPS)实现:
用公式计算总斜杠数量,替换最后一个斜杠为特殊标记后截取内容,假设URL存放在A2单元格,公式为:=RIGHT(A2,LEN(A2)-FIND("~",SUBSTITUTE(A2,"/","~",LEN(A2)-LEN(SUBSTITUTE(A2,"/",""))))) - 代码(Python)实现:
直接按斜杠拆分字符串后取最后一段,代码为:url.split("/")[-1]
适配末尾带斜杠的URL提取
只需要新增一步「先清理URL末尾的斜杠」的预处理逻辑,再走常规提取流程即可:
- 电子表格(Excel/WPS)实现:
先判断末尾字符是否为斜杠,是的话先移除再执行提取,公式为:=LET(clean_url,IF(RIGHT(A2,1)="/",LEFT(A2,LEN(A2)-1),A2),RIGHT(clean_url,LEN(clean_url)-FIND("~",SUBSTITUTE(clean_url,"/","~",LEN(clean_url)-LEN(SUBSTITUTE(clean_url,"/",""))))))
无LET函数的低版本Excel可以把clean_url对应的逻辑直接代入后续计算。 - 代码(Python)实现:
先移除末尾所有斜杠再拆分取最后一段,代码为:url.rstrip("/").split("/")[-1] - 通用正则实现:
无需预处理,直接用正则匹配目标内容,表达式为:[^/]+(?=/?$)
内容的提问来源于stack exchange,提问作者Tom
相关产品推荐
相关产品推荐

