You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Scrapy指定类选择失败求助:如何抓取页面中所有木匠条目

解决Scrapy选中木匠条目问题
  • 修正CSS选择器语法
    你写的div.a-artisanTease to-animate是错误写法——a-artisanTease和to-animate是同一个<div>标签的两个类名,CSS选择器中同一元素的多类名需用.连接,正确写法为:
response.css('div.a-artisanTease.to-animate')

如果部分条目加载后没有to-animate类,也可以只保留核心类名匹配所有条目:

response.css('div.a-artisanTease')
  • 排查动态加载问题
    若修正选择器后仍无结果,大概率是页面内容通过JavaScript动态渲染的——Scrapy默认Request仅获取静态HTML,不会执行JS。可采用两种方案解决:

    • 结合Selenium:模拟浏览器加载页面,等待JS渲染完成后再抓取元素
    • 直接请求数据接口:打开浏览器开发者工具(F12),切换到Network标签过滤XHR/Fetch请求,找到返回木匠数据的API接口,直接请求该接口获取结构化数据,这种方式比抓页面更高效
  • 验证选择器有效性
    可以在浏览器开发者工具的Console面板中执行document.querySelectorAll('div.a-artisanTease')测试选择器,能返回结果说明选择器没问题,反之则需要重新定位元素路径。

内容的提问来源于stack exchange,提问作者user2502913

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.08 10:58:12