You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用XPath 1.0在Screaming Frog中适配两种HTML结构提取商品价格?

适配两种HTML结构的XPath 1.0商品价格提取方案

针对你遇到的两种页面结构,使用以下XPath可以同时匹配两种情况,在Screaming Frog中批量提取商品价格:

//div[@class="artikel-price"]/(text()|b/text())[normalize-space()][contains(., '€')]

规则说明

  • (text()|b/text()):同时匹配div.artikel-price的直接文本节点,以及其下<b>标签内的文本节点,覆盖两种页面结构
  • normalize-space():过滤掉空文本节点(比如换行、多余空格),避免无效匹配
  • contains(., '€'):确保只提取包含欧元符号的价格文本,排除其他无关内容

对应页面结构示例

结构1(价格为div直接子文本):

<div class="artikel-price">
  6,99 €
  <sup>...</sup>
  <span>...</span>
</div>

结构2(价格在b标签内):

<div class="artikel-price">
  <b>12,99 €</b>
  <div>...</div>
</div>

使用方法

在Screaming Frog的「Configuration > Custom > Extraction」中添加新规则,选择「XPath」类型,将上述XPath填入,提取类型选「Text」,即可批量抓取所有页面的商品价格。

内容的提问来源于stack exchange,提问作者user23353735

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.30 18:06:01