如何用XPath获取指定div文本:排除span、ad,保留strong内容
解决方案
可以使用以下XPath查询语句来实现需求:
//div[@class='xyz']//text()[not(parent::span or parent::ad)]
语句说明:
//div[@class='xyz']:精准定位到class属性为xyz的div容器//text():选取该div下所有层级的文本节点[not(parent::span or parent::ad)]:通过过滤条件排除父节点是<span>或<ad>的文本,自动保留<strong>标签下的文本内容(因为它们的父节点是<strong>,不在排除范围内)
执行这个XPath后,会得到符合要求的文本内容:
This is a great opportunity .
And, this can be marketed to a larger market.
So, eventually European sector is out goal.
内容的提问来源于stack exchange,提问作者rettiml
相关产品推荐
相关产品推荐

