You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何获取元素文本时排除指定内部子元素的文本内容

解决方法

要拿到div下直接嵌套的nobr里的「10.99」,有两种靠谱的实现方式:

方法一:直接定位目标nobr元素

最简洁稳妥的方式是用XPath直接选中div的直接子级nobr元素,定位器写法如下:

//div[@contains(@class, 'priceClass')]/nobr

如果页面中该div下可能存在多个nobr子元素,可加索引确保拿到第一个:

//div[@contains(@class, 'priceClass')]/nobr[1]

获取这个元素的文本就能得到10.99,完全不会包含span块里的内容。

方法二:排除span后提取div文本(适合特殊场景)

如果必须通过div元素来提取文本,需要先排除span节点的内容,可以用XPath的节点筛选逻辑:

string(//div[@contains(@class, 'priceClass')]/node()[not(self::span)])

这个表达式会提取div下除span之外所有节点的文本,之后清理掉多余空白字符就能得到10.99。不过这种方法需要额外处理空格,实用性不如方法一。

你提到原定位器返回14.99,大概率是因为获取div文本时会默认包含所有子元素的内容,或是页面中存在其他匹配div.priceClass的元素。直接定位目标nobr是最不易出错的方案。

内容的提问来源于stack exchange,提问作者Dragan94

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.16 04:55:28