You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

基于BeautifulSoup筛选指定标签内容的网页爬取求助

修正后的BeautifulSoup爬取代码(筛选指定标签内容)

没问题!我来帮你调整代码,实现只输出标签内容等于AAAAAAAAAAA的名称与标签组合。

核心思路

  • 遍历每个包含名称(id='name')和标签(id='tag')的div容器
  • 先校验元素是否存在,避免空值报错
  • 增加条件判断:仅当标签文本严格等于AAAAAAAAAAA时,才输出对应组合

完整代码示例

from bs4 import BeautifulSoup
import requests

# 替换为你的目标网页URL
target_url = "https://your-target-page.com"
page_response = requests.get(target_url)
soup = BeautifulSoup(page_response.text, "html.parser")

# 遍历所有包含名称和标签的div(替换成你实际的div类名)
for content_div in soup.find_all("div", class_="your-div-class-name"):
    # 获取名称和标签元素
    name_tag = content_div.find(id="name")
    tag_tag = content_div.find(id="tag")
    
    # 确保元素存在,避免AttributeError
    if name_tag and tag_tag:
        name = name_tag.get_text(strip=True)
        tag = tag_tag.get_text(strip=True)
        
        # 筛选标签内容为'AAAAAAAAAAA'的条目
        if tag == "AAAAAAAAAAA":
            print(f"{name}: {tag}")

关键说明

  • 记得把"your-div-class-name"替换成网页中实际包裹名称和标签的div类名
  • strip=True用来去除文本前后的空格、换行符,避免因空白字符导致判断不匹配
  • 如果你需要忽略大小写或做部分匹配,可以把条件调整为tag.strip().upper() == "AAAAAAAAAAA".upper()这类逻辑

示例输出

General English: Elementary AAAAAAAAAAA
TOEFL iBT: Reading AAAAAAAAAAA
Grammar for IELTS AAAAAAAAAAA

内容的提问来源于stack exchange,提问作者RahimpoorDeveloper

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.12 04:22:00