如何使用Selenium(Firefox驱动)获取HTML头部title标签内的文本
问题原因
<title>标签位于文档<head>区段,不属于页面可见渲染内容,Selenium的.text属性默认仅返回元素的可见文本内容,因此获取结果为空。
可用解决方案
你可以任选以下任意一种方式获取目标内容:
- 方案1(最简便):直接调用Selenium内置的
driver.title属性获取当前页面标题,无需额外定位元素driver.get(url) # 直接获取完整标题文本 full_title = driver.title # 提取文件名1-002.jpg,按空格分割取第一部分即可 target_file_name = full_title.split()[0] - 方案2:通过元素属性
textContent获取,该属性不受元素可见性限制,可返回标签内完整文本driver.get(url) title_element = driver.find_element_by_xpath('/html/head/title') full_title = title_element.get_attribute('textContent') target_file_name = full_title.split()[0] - 方案3:执行JavaScript获取,兼容性更高
driver.get(url) full_title = driver.execute_script("return document.title;") target_file_name = full_title.split()[0]
内容的提问来源于stack exchange,提问作者Max Chung
相关产品推荐
相关产品推荐

