You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用XPath从字符串元素中提取属性值(获取EAN码)

如何用XPath提取div元素的data-product-id属性值

完全可行,你只需要调整XPath的写法,把提取文本的text()换成提取属性的@属性名语法即可。

具体XPath表达式

  • 提取所有div元素的data-product-id属性值:
    //div/@data-product-id
    
  • 精准定位目标div(结合data-retailrocket-markup-block属性过滤),提取对应属性值:
    //div[@data-retailrocket-markup-block="60c8602d97a528373cb51d77"]/@data-product-id
    

实际使用示例

比如在Python的lxml库中使用:

from lxml import etree

# 你的HTML字符串
html_content = '''<div data-retailrocket-markup-block="60c8602d97a528373cb51d77" data-product-id="8710429017146"></div>'''
tree = etree.HTML(html_content)
# 提取EAN码
ean_code = tree.xpath('//div[@data-retailrocket-markup-block="60c8602d97a528373cb51d77"]/@data-product-id')[0]
print(ean_code)  # 输出:8710429017146

如果是在浏览器开发者工具中测试,直接在控制台输入:

$x('//div/@data-product-id')

就能看到返回的属性值列表。

内容的提问来源于stack exchange,提问作者Jarik Witteveen

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.02 14:05:23