如何用Python/BeautifulSoup获取HTML中多个存在的span的title属性?
获取所有span标签title并拼接的实现方法
假设你使用的是BeautifulSoup库,可通过以下方式实现需求:
- 用
find_all方法替代find,获取所有目标<span>标签(建议指定class_='material-part'来精准匹配,避免抓取无关元素) - 遍历所有匹配到的span元素,提取每个元素的
title属性 - 使用
,作为分隔符,将所有title字符串拼接成目标格式
代码示例
# 获取所有带material-part类的span标签 span_elements = row[-1].find_all('span', class_='material-part') # 提取title并拼接成字符串 title_str = ', '.join([span['title'] for span in span_elements]) # 输出结果:SLT-4 2435, SLT-6 2631 print(title_str)
如果不需要限定class,也可以直接用row[-1].find_all('span'),但这样可能会匹配到页面中其他无关的span标签,所以更推荐加上class筛选来保证结果准确。
内容的提问来源于stack exchange,提问作者sampeterson
相关产品推荐
相关产品推荐

