如何获取Ingredients标题下对应p标签内值的XPath?
XPath提取Ingredients标题下p标签内容方案
你当前的XPath已经实现了定位到「Ingredients」标题的文本内容,要提取标题下方对应的p标签内容,使用following-sibling轴即可实现:
- 若仅需提取标题下方紧邻的第一个p标签内容,使用以下XPath:
//div[@id="important-information"]//h4[text()='Ingredients:']/following-sibling::p[1]/text()
语法说明:
following-sibling::p[1]表示选中当前h4标签同层级、排在其后方的第一个p标签,刚好对应标题下方的成分内容块。如果原网页的div标签名是大写,把路径里的div改成DIV即可。
- 若标题下方所有p标签都属于成分列表内容,去掉路径里的
[1]即可提取全部p标签内容://div[@id="important-information"]//h4[text()='Ingredients:']/following-sibling::p/text()
内容的提问来源于stack exchange,提问作者Kanchan
相关产品推荐
相关产品推荐

