如何使用XPath从字符串元素中提取属性值(获取EAN码)
如何用XPath提取div元素的data-product-id属性值
完全可行,你只需要调整XPath的写法,把提取文本的text()换成提取属性的@属性名语法即可。
具体XPath表达式
- 提取所有div元素的
data-product-id属性值://div/@data-product-id - 精准定位目标div(结合
data-retailrocket-markup-block属性过滤),提取对应属性值://div[@data-retailrocket-markup-block="60c8602d97a528373cb51d77"]/@data-product-id
实际使用示例
比如在Python的lxml库中使用:
from lxml import etree # 你的HTML字符串 html_content = '''<div data-retailrocket-markup-block="60c8602d97a528373cb51d77" data-product-id="8710429017146"></div>''' tree = etree.HTML(html_content) # 提取EAN码 ean_code = tree.xpath('//div[@data-retailrocket-markup-block="60c8602d97a528373cb51d77"]/@data-product-id')[0] print(ean_code) # 输出:8710429017146
如果是在浏览器开发者工具中测试,直接在控制台输入:
$x('//div/@data-product-id')
就能看到返回的属性值列表。
内容的提问来源于stack exchange,提问作者Jarik Witteveen
相关产品推荐
相关产品推荐

