Selenium中page_source返回字符串引发find_element报错的解决方法
Selenium代码错误修复方案
错误原因
browser.page_source返回的是HTML格式的字符串,字符串类型没有find_element方法,直接调用会触发属性不存在的错误。
修复方法一:直接通过WebDriver对象查找元素
不需要先获取page_source,直接用浏览器实例browser调用元素查找方法,这是Selenium的标准用法:
browser = webdriver.Chrome() browser.get(url) error_text = browser.find_element(By.ID, 'ctl00_MainContentPlaceHolder_ModalErrorText').text
修复方法二:用静态HTML解析库处理(仅适用于静态内容)
如果只是需要解析静态HTML源码,可以用BeautifulSoup这类库配合page_source的结果,但这种方式无法处理动态加载的元素,也不能和元素交互:
from bs4 import BeautifulSoup browser = webdriver.Chrome() browser.get(url) htmlDoc300 = browser.page_source soup = BeautifulSoup(htmlDoc300, 'html.parser') error_text = soup.find(id='ctl00_MainContentPlaceHolder_ModalErrorText').get_text()
关于字符串转WebDriver对象的问题
不能将HTML字符串转换为WebDriver对象。WebDriver对象是和真实浏览器实例绑定的,包含会话管理、浏览器控制、动态交互等核心能力;而HTML字符串只是静态的页面文本,没有任何和浏览器的关联,因此无法通过字符串生成WebDriver对象。
内容的提问来源于stack exchange,提问作者Matteo Caruso
相关产品推荐
相关产品推荐

