如何通过Python Selenium下载src为blob格式的HTML图片?
解决Selenium自动化Adobe抠图工具时Blob格式图片的下载问题
当你遇到Blob格式的图片URL无法用urllib直接下载时,原因是Blob URL是浏览器会话内的临时内部引用,外部工具无法直接解析。你可以通过以下两种方法获取图片数据并保存:
方法一:通过JavaScript将Blob图片转为Base64编码
利用浏览器的Canvas API,将Blob图片绘制到画布后导出为Base64,再在Python中解码保存:
from selenium import webdriver from selenium.webdriver.common.by import By import base64 # 初始化浏览器并打开工具页面 driver = webdriver.Chrome() driver.get("https://express.adobe.com/tools/remove-background") # 此处需补充上传图片、等待抠图完成的逻辑(根据页面元素定位实现) # 定位到预览图的img元素 preview_img = driver.find_element(By.CSS_SELECTOR, "img[src^='blob:']") # 执行JS脚本,将Blob图片转为Base64 base64_str = driver.execute_script(""" const img = arguments[0]; const canvas = document.createElement('canvas'); canvas.width = img.naturalWidth; canvas.height = img.naturalHeight; const ctx = canvas.getContext('2d'); ctx.drawImage(img, 0, 0); return canvas.toDataURL('image/png'); """, preview_img) # 去除Base64前缀并解码 img_bytes = base64.b64decode(base64_str.split(',')[1]) # 保存图片到本地 with open("抠图结果.png", "wb") as f: f.write(img_bytes) driver.quit()
方法二:直接从Canvas元素获取(若预览用Canvas渲染)
Adobe抠图工具的预览区域可能直接使用Canvas渲染结果,此时可直接提取Canvas的Base64数据:
# 定位Canvas元素(需根据页面实际结构调整选择器) canvas = driver.find_element(By.CSS_SELECTOR, "canvas") # 获取Canvas的Base64编码 base64_str = driver.execute_script("return arguments[0].toDataURL('image/png');", canvas) # 后续解码、保存步骤同方法一
关键说明
Blob URL仅在当前浏览器会话内有效,无法通过外部HTTP请求访问。通过浏览器执行JavaScript,能直接读取Blob对应的图片数据,转为通用的Base64格式后即可在Python中处理保存。
内容的提问来源于stack exchange,提问作者Tory
相关产品推荐
相关产品推荐

