You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用RSelenium提取HTML中的数字57?当前仅获取「Search Results:」

解决方法

你的代码只拿到「Search Results:」是因为你定位的是<span id="resultListHeadingName">元素,而数字57是它的父元素<h1>的直接文本内容,不属于这个span。要拿到目标数字,需要调整定位逻辑,以下是两种可行方案:

方案一:定位父元素h1后提取数字

先获取h1的完整文本,再用正则表达式提取目标数字:

# 定位包含完整文本的h1元素(用class定位)
h1_element <- remDr$findElement(using = 'class', 'page-title')
# 获取h1的全部文本内容
full_text <- h1_element$getElementText() %>% unlist()
# 用正则提取"of "后面的数字(精准匹配目标57)
target_number <- stringr::str_extract(full_text, "(?<=of )\\d+")
# 输出结果
print(target_number)

方案二:用XPath直接定位h1并提取数字

如果h1的class组合唯一,也可以用XPath直接定位:

# 通过XPath定位h1元素
full_text <- remDr$findElement(using = 'xpath', '//h1[@class="page-title alt selectorgadget_selected"]')$getElementText() %>% unlist()
# 提取最后一位数字(也适用于其他类似格式的结果)
target_number <- stringr::str_extract(full_text, "\\d+$")
print(target_number)

补充说明

  • 两种方案都需要先安装并加载stringr包(如果没装的话,先运行install.packages("stringr"))。
  • 正则表达式可以根据实际需求调整:(?<=of )\\d+是精准匹配"of "后面的数字,\\d+$是匹配文本末尾的数字,两种都能拿到57。

内容的提问来源于stack exchange,提问作者Lorenz Oehler

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.15 06:30:45