You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Python Selenium定位并点击每日文件名变化的Excel下载链接

问题描述

页面上的Excel下载链接HTML结构如下:

<a id="hlExcel" href="Reports\DC_REG_638123088090882623.xls" target="_blank"><img src="Images/Excel.gif" alt="Click to view a Excel version"></a>

我每天需要下载这个Excel文件,但文件名称每日都会变化。我尝试了以下代码:

link = browser.find_element_by_css_selector('["href="Reports"]')
link.click()

现在用Python Selenium,请问如何正确定位并点击该Excel下载链接?

解决方案

你可以用以下几种可靠的方式定位这个链接:

1. 通过ID定位(最推荐)

这个链接有唯一的id="hlExcel",直接用ID定位是最稳定的:

from selenium.webdriver.common.by import By

link = browser.find_element(By.ID, "hlExcel")
link.click()

如果你的Selenium版本较旧(v4.0之前),可以用旧版语法:

link = browser.find_element_by_id("hlExcel")
link.click()

2. 通过href包含固定路径定位

如果ID不可用,可通过CSS选择器匹配href包含固定前缀Reports\的链接:

from selenium.webdriver.common.by import By

link = browser.find_element(By.CSS_SELECTOR, 'a[href*="Reports\\"]')
link.click()

也可以用XPath实现相同逻辑:

from selenium.webdriver.common.by import By

link = browser.find_element(By.XPATH, '//a[contains(@href, "Reports\\")]')
link.click()

注意:Python字符串中反斜杠需要转义,所以写成Reports\\。

3. 通过图片的alt属性定位

还可以通过链接内图片的alt文本反向定位父级链接:

from selenium.webdriver.common.by import By

link = browser.find_element(By.XPATH, '//img[@alt="Click to view a Excel version"]/parent::a')
link.click()

内容的提问来源于stack exchange,提问作者Anthony

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.31 08:56:07