如何让Selenium遇到超时错误后继续执行而非终止?
解决Selenium页面加载超时导致程序终止的问题
没问题,这个需求用Python的异常捕获机制就能轻松搞定!我帮你调整了代码,不仅实现了超时跳过当前网站继续处理下一个的功能,还改成了批量处理URL列表的形式,方便你直接扩展使用:
from pyvirtualdisplay import Display from time import sleep import sys reload(sys) sys.setdefaultencoding('utf-8') from selenium import webdriver from selenium.webdriver.firefox.options import Options from selenium.common.exceptions import TimeoutException, WebDriverException # 初始化虚拟显示和浏览器驱动(修复了你原代码里size参数的语法错误) display = Display(visible=0, size=(800,600)) display.start() driver = webdriver.Firefox(executable_path='/usr/local/lib/geckodriver/geckodriver') driver.set_page_load_timeout(60) # 要处理的网站URL列表,你可以自行添加/修改 target_urls = [ "https://google.com", "https://example.com", "https://some-potentially-slow-site.com" ] for url in target_urls: try: print(f"正在处理URL: {url}") driver.get(url) print(f"标题获取成功: {driver.title}") # 可选:处理完一个网站后清理缓存,避免影响下一个站点的加载 driver.delete_all_cookies() sleep(1) # 可选:添加短暂延迟,避免请求过于频繁触发反爬 except TimeoutException: print(f"⚠️ URL加载超时,跳过当前站点: {url}") continue # 直接进入下一次循环,处理下一个URL except WebDriverException as e: print(f"❌ 处理URL时出现其他错误: {url}, 错误信息: {str(e)}") continue # 程序结束后记得释放资源 driver.quit() display.stop()
关键修改点说明:
- 精准捕获超时异常:导入Selenium专属的
TimeoutException类,专门捕获页面加载超时的情况,触发后打印提示并直接跳过当前URL - 批量处理URL:把目标网站放进列表循环遍历,比单个处理更灵活易扩展
- 通用异常防护:额外捕获
WebDriverException,处理其他可能的浏览器驱动错误(比如网络中断、站点无法访问等),确保程序不会因意外错误终止 - 资源优化:添加了清理cookies的操作和可选延迟,同时在最后关闭浏览器和虚拟显示,避免资源泄漏
这样修改后,程序遇到超时或其他浏览器相关错误时,都会自动跳过当前网站,继续处理下一个URL,不会直接终止啦!
内容的提问来源于stack exchange,提问作者WeekSky
相关产品推荐
相关产品推荐

