如何用Python的Selenium获取HTML span标签内元素?解决找不到元素异常
问题解决:Selenium爬取铁人三项比赛结果时找不到span元素
错误原因
页面中class为text-bold的元素并非全部包含<span>子元素,你的代码里用find_element(By.TAG_NAME, "span")强制查找每个text-bold元素下的span,遇到没有span的元素就会抛出NoSuchElementException。
解决方案
提供三种可行解决方式,按需选择:
方式1:直接获取父元素文本
因为<span>里的文本就是<td class="text-bold">的文本内容,无需嵌套查找:
names = [] # 找到所有class为text-bold的元素 name_elements = driver.find_elements(By.CLASS_NAME, "text-bold") for name in name_elements: info = name.text.strip() # 过滤空文本,避免无效数据 if info: names.append(info)
方式2:捕获异常跳过无效元素
用try-except捕获找不到span的异常,直接跳过这类元素:
from selenium.common.exceptions import NoSuchElementException names = [] name_elements = driver.find_elements(By.CLASS_NAME, "text-bold") for name in name_elements: try: info = name.find_element(By.TAG_NAME, "span").text.strip() names.append(info) except NoSuchElementException: # 没有span的元素直接跳过 continue
方式3:用精确CSS选择器定位目标元素
直接定位class为text-bold的td下的span,从根源避免无效元素:
names = [] # 直接查找符合条件的span元素 name_spans = driver.find_elements(By.CSS_SELECTOR, "td.text-bold > span") for span in name_spans: info = span.text.strip() if info: names.append(info)
额外建议:处理页面加载问题
如果页面是动态加载的,可能元素还未渲染完成就执行了查找,建议添加显式等待确保元素加载:
from selenium.webdriver.support.ui import WebDriverWait from selenium.webdriver.support import expected_conditions as EC # 等待目标元素加载,最多等待10秒 wait = WebDriverWait(driver, 10) name_spans = wait.until(EC.presence_of_all_elements_located((By.CSS_SELECTOR, "td.text-bold > span"))) names = [span.text.strip() for span in name_spans if span.text.strip()]
内容的提问来源于stack exchange,提问作者Etienne
相关产品推荐
相关产品推荐

