You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Python获取HTML下拉菜单中href元素的id属性?

依赖准备

首先安装HTML解析库BeautifulSoup:

pip install beautifulsoup4

如果需要抓取在线网页内容,额外安装requests库:

pip install requests

代码实现

情况1:处理本地HTML模板字符串

直接解析你提供的HTML代码,提取目标id:

from bs4 import BeautifulSoup

# 你的HTML模板内容
html_content = """
<div class="dropdown">
     <button class="dropbtn">Test Validation</button>
     <div class="dropdown-content">
          <a id= 'search' href="/TEST_TYPE">SEARCH</a>
          <a id= 'logview' href="/TEST_TYPE">LOG VIEW</a>
          <a id= 'ttype' href="/TEST_TYPE">TEST TYPE</a>
     </div>
</div>
"""

# 解析HTML
soup = BeautifulSoup(html_content, 'html.parser')

# 定位dropdown容器下的dropdown-content内所有<a>标签
dropdown_links = soup.select('div.dropdown div.dropdown-content a')

# 提取所有id属性
link_ids = [link.get('id') for link in dropdown_links]

print(link_ids)
# 输出: ['search', 'logview', 'ttype']

情况2:抓取在线页面内容

如果HTML来自在线页面,先获取页面内容再解析:

import requests
from bs4 import BeautifulSoup

# 目标页面URL
url = "你的页面URL"
response = requests.get(url)
response.encoding = 'utf-8'

soup = BeautifulSoup(response.text, 'html.parser')
dropdown_links = soup.select('div.dropdown div.dropdown-content a')
link_ids = [link.get('id') for link in dropdown_links]

print(link_ids)

判断跳转来源的思路

提取到id后,可通过以下方式判断跳转来源:

内容的提问来源于stack exchange,提问作者noob

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.12 08:25:58