SeleniumBase爬虫遭“选择相似图片”人机验证拦截问题
Royal Mail跟踪页面爬取遭遇CAPTCHA拦截问题
使用SeleniumBase爬取Royal Mail快递跟踪页面(目标URL:https://www.royalmail.com/track-your-item#/tracking-results/QF085212272GB)并截图时,被网站的机器人检测系统识别,弹出“选择相似图片”的CAPTCHA验证框,最终截图显示的是验证界面,而非预期的正常快递跟踪页面。
环境信息
- Docker基础镜像:python3.9-slim
- SeleniumBase版本:4.28.0
- Chromium版本:126.0.6478.126
- ChromeDriver版本:126.0.6478.126
执行代码
from seleniumbase import SB fallback_ua = 'Mozilla/5.0 (Linux; Android 10; K) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/114.0.0.0 Mobile Safari/537.36' chromium_arg = '--disable-gpu,--disable-blink-features=AutomationControlled' with SB(uc=True, headless2=True, agent=fallback_ua, chromium_arg=chromium_arg) as sb: url = "https://www.royalmail.com/track-your-item#/tracking-results/QF085212272GB" sb.uc_open_with_reconnect(url, 3) sb.sleep(1) sb.save_screenshot('ss.png')
内容的提问来源于stack exchange,提问作者Vivek
相关产品推荐
相关产品推荐

