如何使用Python批量下载URL仅数字可变的网站图片?
Python 批量下载序列图片实现方案
你可以通过遍历1~92的可变数字,动态拼接下载链接与对应文件名实现批量下载,完整代码如下:
import urllib.request # 链接模板,{} 为可变数字的占位位置 base_url = "https://image.slidesharecdn.com/marketinginternationalsept2013-150330215818-conversion-gate01/95/marketing-international-{}-638.jpg?cb=1427770871" # 遍历1到92的所有页码 for page_num in range(1, 93): # 拼接得到当前页的完整下载链接 current_url = base_url.format(page_num) # 生成对应文件名,按序号排序方便后续查看 file_name = f"marketing_slide_{page_num}.jpg" # 执行下载 urllib.request.urlretrieve(current_url, file_name) # 打印下载进度,不需要可以删除 print(f"已完成第 {page_num}/92 张图片下载")
如果需要避免网络波动导致脚本中断,可以加上异常捕获逻辑,优化版本如下:
import urllib.request import time base_url = "https://image.slidesharecdn.com/marketinginternationalsept2013-150330215818-conversion-gate01/95/marketing-international-{}-638.jpg?cb=1427770871" for page_num in range(1, 93): current_url = base_url.format(page_num) file_name = f"marketing_slide_{page_num}.jpg" try: urllib.request.urlretrieve(current_url, file_name) print(f"已完成第 {page_num}/92 张图片下载") # 每次下载后间隔1秒,避免请求频率过高触发限制,可自行调整 time.sleep(1) except Exception as e: print(f"第 {page_num} 张图片下载失败,错误信息:{e}")
内容的提问来源于stack exchange,提问作者Marinos TBH
相关产品推荐
相关产品推荐

