Python如何从响应内容中提取并打印authURL参数值
提取authURL取值的Python实现方案
方案1:正则表达式快速提取(适合简单场景)
如果仅需要匹配特定格式的authURL,直接用正则匹配是最简便的方式:
import re # html_content 为你拿到的HTML响应完整内容 html_content = '''你的HTML响应内容填这里''' # 匹配规则:忽略authURL和值之间的任意空格,捕获双引号包裹的取值 match_res = re.search(r'"authURL"\s*:\s*"([^"]+)"', html_content) if match_res: auth_url = match_res.group(1) print(auth_url)
优点:无需安装额外依赖,代码量小,执行速度快
方案2:先解析HTML再提取(适合结构复杂、需要更精准匹配的场景)
如果担心正则误匹配到其他位置的相同字段,可以先解析HTML取出代码块内容再处理:
- 先安装依赖
pip install beautifulsoup4
- 完整实现代码
from bs4 import BeautifulSoup import json # html_content 为你拿到的HTML响应完整内容 html_content = '''你的HTML响应内容填这里''' # 解析HTML,提取<pre><code>标签内的文本 soup = BeautifulSoup(html_content, 'html.parser') code_text = soup.find('pre').find('code').get_text(strip=True) # 把代码块内容补全为合法JSON格式后解析 auth_data = json.loads(f'{{{code_text}}}') print(auth_data['authURL'])
优点:匹配精准,不会命中HTML其他位置的authURL字符串,适配性更强
内容的提问来源于stack exchange,提问作者XLevi
相关产品推荐
相关产品推荐

