You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python代码报'NoneType' object has no attribute 'text'错误的修复方法

修复'NoneType' object has no attribute 'text'错误并抓取网页标题

错误原因

这个报错是因为soup.find("h1")或后续的子元素查找返回了None——找不到目标HTML元素,此时调用.text就会触发属性错误。另外你的代码存在重复请求网页的冗余操作,且选择器过度依赖特定子元素的class,一旦页面结构微调就会失效。

修复后的代码

import requests
from bs4 import BeautifulSoup

url = "https://www.spiegel.de/politik/deutschland/berlin-kai-wegner-mit-einfacher-mehrheit-zum-regierenden-buergermeister-gewaehlt-a-5a9f9458-0987-4158-b898-c06791016d28"

# 仅请求一次网页,避免冗余请求
response = requests.get(url)
response.raise_for_status()  # 捕获HTTP请求失败(如404、500)的情况
soup = BeautifulSoup(response.text, 'html.parser')

# 优先从h1标签提取标题,同时增加备选方案提升容错性
try:
    title_element = soup.find("h1")
    if title_element:
        # 提取h1下所有文本,不依赖特定子元素class
        title = title_element.get_text(strip=True)
        print("网页标题:", title)
    else:
        # 备选:从meta标签抓取页面标题
        meta_title = soup.find("meta", property="og:title")
        if meta_title:
            title = meta_title.get("content", "")
            print("网页标题(meta):", title)
        else:
            print("未找到标题元素")
except Exception as e:
    print(f"抓取出错: {str(e)}")

核心优化说明

  • 移除重复的网页请求,减少不必要的网络开销
  • 加入response.raise_for_status(),主动处理请求失败的场景
  • 简化选择器逻辑,优先使用更稳定的h1标签提取标题,同时增加meta标签作为备选
  • 使用get_text(strip=True)替代.text,自动去除文本前后的空白字符
  • 添加异常捕获,避免单个环节出错导致程序直接崩溃

内容的提问来源于stack exchange,提问作者Travis

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.18 07:52:49