如何用Selenium Python抓取Nordpool无属性绑定的电价与日期
解决Nordpool网站日期与电价文本提取问题
问题分析
你之前的代码定位的是整个表格(datatable)而非目标元素,且未调用WebElement的.text属性提取文本;另外页面元素是动态渲染的,仅等待元素存在可能不足以确保文本加载完成。
解决方案
使用更精准的定位方式,等待元素可见后,通过.text属性提取文本:
修正后的代码
from selenium import webdriver from selenium.webdriver.common.by import By from selenium.webdriver.support.ui import WebDriverWait from selenium.webdriver.support import expected_conditions as EC url = "https://www.nordpoolgroup.com/en/Market-data1/#/nordic/table" PATH = "C:/PATH" driver = webdriver.Chrome(PATH) try: driver.get(url) # 等待日期元素可见并提取文本 date_element = WebDriverWait(driver, 15).until( EC.visibility_of_element_located((By.XPATH, "/html/body/div[2]/div/div/div[2]/div[2]/div/div[2]/div/div[2]/div[1]/div[2]/table/tbody/tr[1]/td[1]")) ) date_text = date_element.text print("日期:", date_text) # 等待电价元素可见并提取文本 price_element = WebDriverWait(driver, 15).until( EC.visibility_of_element_located((By.XPATH, "/html/body/div[2]/div/div/div[2]/div[2]/div/div[2]/div/div[2]/div[1]/div[2]/table/tbody/tr[1]/td[2]")) ) price_text = price_element.text print("电价:", price_text) finally: driver.quit()
关键优化点
- 定位精准化:直接定位到目标
<td>元素,而非整个表格。 - 等待可见性:用
visibility_of_element_located替代presence_of_element_located,确保元素已渲染完成、文本已加载。 - 提取文本:调用WebElement的
.text属性,获取元素显示的文本内容。
替代定位方案(更健壮)
如果绝对XPath容易因页面结构变化失效,可改用相对定位:
- 日期元素:
By.CSS_SELECTOR, "td.row-name.ng-binding" - 电价元素:
By.XPATH, "//td[@class='row-name ng-binding ng-scope']/following-sibling::td[1]"
内容的提问来源于stack exchange,提问作者Thamska
相关产品推荐
相关产品推荐

