You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

表格存在多条相同值时Xpath提取首条匹配数据异常问题咨询

问题解决方案

原因说明

你当前写法的问题出在XPath的优先级逻辑://*[筛选条件][1]的语义是匹配所有符合筛选条件、且为自身父节点下第一个符合该条件的子节点的元素。
你的HTML结构里两个匹配到的td元素,分别属于两个不同的tr父节点,且每个tr下只有1个符合文本条件的td,所以两个元素都满足[1]的限定,自然会返回两个结果。

修正方法

把你需要筛选的整个路径用括号包裹后,再在括号外加位置索引,此时语义变为「先全局匹配所有符合条件的元素,再取整个结果集中的第一个」,符合你的需求。

修正后的XPath语句

(//*[contains(text(),'1234567890123456789012345678901234567890123456789012345678901234567890')])[1]

注:你原写法里的contains(@class, '')没有实际过滤作用,所有元素的class属性都包含空字符串,直接删掉也不影响匹配结果。

可选的更精准写法

如果你明确要取第一个表格行里的对应值,也可以先限定第一个行节点再匹配文本,可读性更高:

//div[contains(@class,'tr')][1]//*[contains(text(),'1234567890123456789012345678901234567890123456789012345678901234567890')]

内容的提问来源于stack exchange,提问作者Suntje

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.26 07:36:06