You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

新手求助:使用Scrapy爬取银行名称时如何选择CSS类标签

解决Scrapy爬取银行名称的CSS选择器问题

嘿,作为Scrapy新手遇到这种选择器困惑太正常啦!刚看了你提供的页面检查截图,我来帮你梳理下怎么定位到银行名称~

从截图里的HTML结构来看,银行名称都嵌套在表格内的<a>标签里,这里给你几个靠谱的CSS选择器写法,你可以根据实际情况选用:

  • 基础精准定位:先找到目标表格(class为table-responsive),再定位里面<td>下的<a>标签文本:

    response.css('table.table-responsive td a::text').extract()
    
  • 利用属性筛选:截图里的<a>标签都带有title属性,也可以通过这个属性来筛选:

    response.css('a[title]::text').extract()
    
  • 指定列定位:如果银行名称固定在表格的第一列,用:nth-child(1)来锁定第一列的<td>,再取里面的文本:

    response.css('table.table-responsive tr td:nth-child(1) a::text').extract()
    

💡 小技巧:推荐用scrapy shell来调试选择器,输入scrapy shell "你的目标网页地址"进入交互模式,直接测试上面的代码,能快速看到返回结果是否符合预期,比直接跑爬虫省时间~

内容的提问来源于stack exchange,提问作者manoj jhajharia

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.28 06:58:22