如何使用BeautifulSoup提取网页中第5个__RequestVerificationToken隐藏元素
解决方案
BeautifulSoup的find_all()方法会按照元素在HTML文档中的从上到下的出现顺序,返回所有符合筛选条件的元素列表,列表下标从0开始计数,因此第5个符合要求的元素对应下标为4。
代码示例
from bs4 import BeautifulSoup # 此处替换为你实际获取到的页面HTML文本 # html = requests.get(target_url).text # 初始化soup对象,如使用lxml解析器可将html.parser替换为lxml soup = BeautifulSoup(html, 'html.parser') # 筛选所有匹配的input元素 all_token_inputs = soup.find_all( 'input', {'name': '__RequestVerificationToken', 'type': 'hidden'} ) # 读取第5个元素的value值 if len(all_token_inputs) >= 5: fifth_token = all_token_inputs[4]['value'] print(fifth_token) else: print("匹配到的元素数量不足5个")
内容的提问来源于stack exchange,提问作者Marc9s
相关产品推荐
相关产品推荐

