使用BeautifulSoup提取指定class的div下span内a标签的href
修复提取特定标签href的Python代码
原代码无法输出内容的核心问题有两个:
- 错误打印字符串字面量
"anchor['href']",而非实际提取的属性值 select()方法返回标签列表,未遍历列表中的每个标签获取href
修复后的代码
import requests from bs4 import BeautifulSoup as bs # 替换为实际目标URL response = requests.get("your_target_url") html = bs(response.content, 'html.parser') # 直接定位所有符合条件的<a>标签:class为arm的div下的span内的a for anchor in html.select(".arm span a"): # 用get方法安全获取href属性,避免标签无href时抛出异常 print(anchor.get('href'))
代码说明
- 选择器
.arm span a一步定位目标标签,无需嵌套循环,简化逻辑 - 使用
get('href')替代直接索引['href'],当标签不存在href属性时会返回None,避免程序崩溃 - 需将
"your_target_url"替换为你要爬取的实际网站URL
内容的提问来源于stack exchange,提问作者user19846911
相关产品推荐
相关产品推荐

