如何使用Selenium WebDriver(Java)获取WebElement及页面HTML源码?
获取WebElement的HTML源码
要获取单个WebElement的完整HTML(包含元素自身标签),调用getAttribute("outerHTML")方法即可;如果只需要元素内部的HTML内容(不含自身标签),则用getAttribute("innerHTML")。
示例代码:
// 定位目标元素 WebElement targetElement = driver.findElement(By.id("your-element-id")); // 获取包含元素自身的完整HTML String elementFullHtml = targetElement.getAttribute("outerHTML"); // 获取元素内部的HTML内容 String elementInnerHtml = targetElement.getAttribute("innerHTML");
获取整个HTML页面的源码
有两种常用实现方式:
- 直接调用WebDriver的
getPageSource()方法,这是最简便的方案,返回当前页面的完整源码:
String fullPageSource = driver.getPageSource();
- 也可以定位
<html>标签,再通过outerHTML获取完整页面源码:
WebElement htmlRoot = driver.findElement(By.tagName("html")); String fullPageHtml = htmlRoot.getAttribute("outerHTML");
内容的提问来源于stack exchange,提问作者Thomas Martin
相关产品推荐
相关产品推荐

