Python Selenium如何同时提取a标签的href链接与对应文本内容
代码调整方案
你可以直接调用Selenium WebElement对象的.text属性获取a标签内的文本内容,调整后的代码如下:
elems = wd.find_elements_by_xpath("//a[@href]") for elem in elems: # 提取链接地址 link_url = elem.get_attribute("href") # 提取对应文本,strip()用于去除首尾多余空白/换行符 link_text = elem.text.strip() # 可按需调整输出格式或存入字典/列表 print(f"链接:{link_url},文本:{link_text}")
特殊情况处理
如果运行时出现获取到的文本为空的情况,可尝试替换.text为elem.get_attribute("textContent").strip(),该属性可以读取到元素内未渲染的文本内容;也可以提前增加元素显式等待逻辑,保证a标签完全渲染后再读取内容。
内容的提问来源于stack exchange,提问作者P_n
相关产品推荐
相关产品推荐

