You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用Selenium Python获取HTML中的目标文本内容

用Selenium提取文本“Mama”的可行方案

先确认你定位元素的方式是正确的(比如用Chrome/Firefox开发者工具验证XPATH/CSS选择器能精准定位到目标元素),再根据目标文本所在的HTML结构选择对应方法:

1. 提取可见元素的文本(最常用)

如果“Mama”是元素的可见文本,直接用元素的text属性,这比get_attribute更直接:

from selenium import webdriver
from selenium.webdriver.common.by import By

driver = webdriver.Chrome()
# 定位到包含"Mama"的元素,示例用CLASS_NAME,你换成自己的定位器
target_element = driver.find_element(By.CLASS_NAME, "target-class")
print(target_element.text)  # 输出"Mama"

2. 提取隐藏元素或JS渲染的文本

如果元素是隐藏状态(比如display: none),或者文本是JS动态插入的,用get_attribute('textContent')提取所有文本内容:

text = target_element.get_attribute('textContent')
print(text.strip())  # 用strip()去掉多余空格

或者用get_attribute('innerText'),它和text类似,但会保留元素的换行格式:

text = target_element.get_attribute('innerText')

3. 提取表单元素的文本(比如input/textarea)

如果“Mama”在input、textarea这类表单元素里,需要提取value属性:

# 示例HTML: <input id="name" value="Mama">
input_element = driver.find_element(By.ID, "name")
text = input_element.get_attribute('value')
print(text)

排查要点

  • 先确认元素定位器是否正确,在开发者工具的控制台用document.querySelector('你的CSS选择器')或者$x('你的XPATH')验证,能找到元素再继续。
  • 如果元素是动态加载的,要加等待(比如WebDriverWait),确保元素加载完成再提取。

内容的提问来源于stack exchange,提问作者Andrean Ahmad Fauzi

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.11 17:01:10