如何在Selenium中用XPath定位指定球队并提取对应伤病数据
问题原因
你写的//div[@class='col-xs-2 col-sm-3']以双斜杠开头,XPath规则里双斜杠是全局搜索整个HTML文档,因此返回的是页面第一个匹配的节点,也就是空军学院队的伤病数据,并不会限定在你已经定位到的科罗拉多队节点下搜索。
修正方案
只需要把XPath改成以.//开头,就可以限定从当前已定位节点的后代节点中搜索,修改后可运行的完整代码如下:
from selenium import webdriver from selenium.webdriver.common.by import By import time driver = webdriver.Chrome('C:\\Users\\Carl\\Downloads\\chromedriver.exe') teams = ['Colorado', 'Kentucky', 'Iowa', 'Nebraska', 'Rutgers', 'Syracuse', 'Oregon', 'San Diego', 'Michigan State'] driver.get("https://www.covers.com/sport/football/ncaaf/injuries") # 等待页面渲染完成,避免定位失败 time.sleep(3) for team in teams: # 方式1:依赖页面ID定位,匹配速度快 team_root_node = driver.find_element(By.ID, team) # 注意XPath以.开头,限定在当前节点的后代节点中搜索 injury_count = team_root_node.find_element(By.XPATH, ".//div[@class='col-xs-2 col-sm-3']").text print(f"{team} 伤病球员数:{injury_count}") # 方式2:不依赖ID,用文本匹配+XPath轴定位,适配性更强 # 直接定位包含球队名的节点,再取它前面同级的伤病数据节点,一步即可拿到结果 # injury_count = driver.find_element(By.XPATH, f"//div[contains(text(), '{team}')]/preceding-sibling::div[@class='col-xs-2 col-sm-3']").text # print(f"{team} 伤病球员数:{injury_count}") driver.quit()
补充说明
如果你需要完全按照你最初的思路,先通过文本匹配定位球队节点,再获取前面相邻节点的内容,直接使用XPath的preceding-sibling轴即可,不需要分两次定位元素,代码灵活性更高,也能适配球队ID不存在或者动态变化的场景。
内容的提问来源于stack exchange,提问作者Molten Marlin
相关产品推荐
相关产品推荐

