如何用XPath 1.0在Screaming Frog中适配两种HTML结构提取商品价格?
适配两种HTML结构的XPath 1.0商品价格提取方案
针对你遇到的两种页面结构,使用以下XPath可以同时匹配两种情况,在Screaming Frog中批量提取商品价格:
//div[@class="artikel-price"]/(text()|b/text())[normalize-space()][contains(., '€')]
规则说明
(text()|b/text()):同时匹配div.artikel-price的直接文本节点,以及其下<b>标签内的文本节点,覆盖两种页面结构normalize-space():过滤掉空文本节点(比如换行、多余空格),避免无效匹配contains(., '€'):确保只提取包含欧元符号的价格文本,排除其他无关内容
对应页面结构示例
结构1(价格为div直接子文本):
<div class="artikel-price"> 6,99 € <sup>...</sup> <span>...</span> </div>结构2(价格在b标签内):
<div class="artikel-price"> <b>12,99 €</b> <div>...</div> </div>
使用方法
在Screaming Frog的「Configuration > Custom > Extraction」中添加新规则,选择「XPath」类型,将上述XPath填入,提取类型选「Text」,即可批量抓取所有页面的商品价格。
内容的提问来源于stack exchange,提问作者user23353735
相关产品推荐
相关产品推荐

