使用BeautifulSoup爬取网页数据时如何提取span标签内的数字
你可以按照以下两步操作提取目标数值:
- 先从匹配的标签中提取文本内容
你当前用的find_all()返回的是符合条件的标签列表,你可以直接改用find()获取单个匹配标签,再调用.text属性取文本:
# 改用find获取单个标签,直接取文本 future_text = data3.find('span', class_='instrument-price_last__KQzyA').text # 如果你要保留find_all的写法,就取列表第一个元素再取文本 # future_text = future[0].text
- 去除千位分隔符后转换为数值
把文本里的逗号替换为空,再转为浮点型即可得到你需要的数值:
target_num = float(future_text.replace(',', '')) print(target_num) # 输出结果:23989.5
内容的提问来源于stack exchange,提问作者Adrian Wong
相关产品推荐
相关产品推荐

