You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用BeautifulSoup调用split()时出现'object is not callable'错误求助

问题分析与解决

错误根源是h_item[i]是BeautifulSoup的Tag对象,不是字符串类型,直接调用.split()方法会触发AttributeError。

修正方案

步骤1:将Tag对象转为字符串

先把Tag转换成可操作的字符串,再执行分割逻辑:

for item in h_soup.findAll('tbody'):
  h_item = item.findAll('a', class_='email')
  for link in h_item:  # 直接遍历元素,不用索引更简洁
      # 将Tag转为字符串
      link_str = str(link)
      # 先判断分割后的列表长度是否足够,避免索引越界
      parts = link_str.split(' ')
      if len(parts) >=5:
          h_email_part = parts[4]
          h_email = h_email_part.split('"')[0]
          print(h_email)

更优写法:直接提取目标内容

如果你的目标是提取a标签里的邮箱地址,通常这类邮箱链接的href属性会是mailto:xxx@xxx.com格式,或者标签文本就是邮箱,完全可以跳过字符串分割,直接提取:

  • 提取href里的邮箱:
for item in h_soup.findAll('tbody'):
  h_item = item.findAll('a', class_='email')
  for link in h_item:
      href = link.get('href', '')
      if href.startswith('mailto:'):
          print(href.replace('mailto:', ''))
  • 提取标签文本里的邮箱:
for item in h_soup.findAll('tbody'):
  h_item = item.findAll('a', class_='email')
  for link in h_item:
      print(link.text.strip())

额外提示

  • 避免用索引遍历列表,直接遍历元素更简洁且不易出错
  • 对split后的结果做长度判断,防止因HTML结构变化导致索引越界错误

内容的提问来源于stack exchange,提问作者andrew.royer

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.17 13:25:11