使用BeautifulSoup读取网页中的图片URL
如何从包含图片的div元素中提取图片URL?
嘿,你已经离成功只差一步啦!现在你拿到了包含图片的div容器,接下来只需要从这个div里定位到<img>标签,再提取它的src属性就能拿到图片URL了。
给你修改后的代码,还加了容错处理避免找不到元素时报错:
from bs4 import BeautifulSoup import requests url = 'https://www.basketball-reference.com/players/h/hardeja01.html' page_request = requests.get(url) soup = BeautifulSoup(page_request.text,"lxml") # 定位到包含图片的div容器 img_div = soup.find("div", {"class": "media-item"}) if img_div: # 从div中找到img标签,提取src属性 # 两种方式都可行,第二种在标签没有src属性时会返回None,更安全 img_src = img_div.find('img')['src'] # img_src = img_div.find('img').get('src') print(img_src) else: print("没有找到包含图片的div元素哦")
简单说下逻辑:你之前的代码只获取到了外层的div容器,而图片的实际URL是存在于div内部<img>标签的src属性里的,所以必须先定位到img标签,再读取它的src属性值。
内容的提问来源于stack exchange,提问作者Eyal S.
相关产品推荐
相关产品推荐

