You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python Selenium如何同时提取a标签的href链接与对应文本内容

代码调整方案

你可以直接调用Selenium WebElement对象的.text属性获取a标签内的文本内容,调整后的代码如下:

elems = wd.find_elements_by_xpath("//a[@href]")
for elem in elems:
    # 提取链接地址
    link_url = elem.get_attribute("href")
    # 提取对应文本,strip()用于去除首尾多余空白/换行符
    link_text = elem.text.strip()
    # 可按需调整输出格式或存入字典/列表
    print(f"链接:{link_url},文本:{link_text}")

特殊情况处理

如果运行时出现获取到的文本为空的情况,可尝试替换.text为elem.get_attribute("textContent").strip(),该属性可以读取到元素内未渲染的文本内容;也可以提前增加元素显式等待逻辑,保证a标签完全渲染后再读取内容。

内容的提问来源于stack exchange,提问作者P_n

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.05 23:06:01