You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用BeautifulSoup读取网页中的图片URL

如何从包含图片的div元素中提取图片URL?

嘿,你已经离成功只差一步啦!现在你拿到了包含图片的div容器,接下来只需要从这个div里定位到<img>标签,再提取它的src属性就能拿到图片URL了。

给你修改后的代码,还加了容错处理避免找不到元素时报错:

from bs4 import BeautifulSoup
import requests
url = 'https://www.basketball-reference.com/players/h/hardeja01.html'
page_request = requests.get(url)
soup = BeautifulSoup(page_request.text,"lxml")

# 定位到包含图片的div容器
img_div = soup.find("div", {"class": "media-item"})

if img_div:
    # 从div中找到img标签,提取src属性
    # 两种方式都可行,第二种在标签没有src属性时会返回None,更安全
    img_src = img_div.find('img')['src']
    # img_src = img_div.find('img').get('src')
    print(img_src)
else:
    print("没有找到包含图片的div元素哦")

简单说下逻辑:你之前的代码只获取到了外层的div容器,而图片的实际URL是存在于div内部<img>标签的src属性里的,所以必须先定位到img标签,再读取它的src属性值。

内容的提问来源于stack exchange,提问作者Eyal S.

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.25 07:45:55