如何使用Python提取URL中的中间路径及标记ID
用Python提取URL中的指定ID
这里有几种简单直接的方法可以提取示例URL里的ID(6906155619):
方法一:字符串分割法
利用URL的固定结构,用split('/')拆分路径后直接取对应位置的元素:
url = "www.roblox.com/catalog/6906155619/Real-Madrid-Home-Kit-21-22-SS-Benzema" # 按斜杠分割URL成列表 path_parts = url.split('/') # 索引2对应的就是目标ID item_id = path_parts[2] print(item_id) # 输出:6906155619
方法二:URL解析库法
用Python内置的urllib.parse模块解析URL,更规范地处理路径部分:
from urllib.parse import urlparse # 建议给URL补上协议(http/https),解析更准确 url = "https://www.roblox.com/catalog/6906155619/Real-Madrid-Home-Kit-21-22-SS-Benzema" parsed_result = urlparse(url) # 拆分路径部分 path_parts = parsed_result.path.split('/') item_id = path_parts[2] print(item_id) # 输出:6906155619
方法三:正则表达式法
如果ID的位置可能变化,但格式是纯数字,可以用正则匹配提取:
import re url = "www.roblox.com/catalog/6906155619/Real-Madrid-Home-Kit-21-22-SS-Benzema" # 匹配/catalog/后面的一串数字 match = re.search(r'/catalog/(\d+)/', url) if match: item_id = match.group(1) print(item_id) # 输出:6906155619
内容的提问来源于stack exchange,提问作者harambifi
相关产品推荐
相关产品推荐

