Python通过隐藏API爬取足球网站数据遇JSONDecodeError求助
解决JSONDecodeError的排查步骤
先别着急解析JSON,先搞清楚服务器返回的到底是什么内容,按下面的步骤逐一排查:
1. 先查看响应的原始内容
把解析JSON的代码换成以下内容,先确认请求状态和返回的原始文本:
import requests params = { 'sclassId': '40', 'subSclassId': '261', 'matchSeason': '2022-2023', 'round': '23', 'flesh': '0.6807624444063407', } response = requests.get('https://football.goaloo2.com/ajax/LeagueOddsAjax', params=params) # 先检查请求状态码 print("请求状态码:", response.status_code) # 打印前500字符的响应内容,避免输出过多 print("响应内容预览:", response.text[:500])
运行后看输出:
- 如果状态码不是200(比如403、404),说明请求被拦截或者接口地址有误
- 如果返回的是HTML页面(比如验证码、登录提示),那就是被反爬机制拦截了
- 如果是乱码文本,说明需要处理编码问题
2. 模拟浏览器请求头
浏览器发起请求时会携带User-Agent等标识,requests默认的请求头很容易被识别,试试添加浏览器请求头:
import requests headers = { 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/118.0.0.0 Safari/537.36' } params = { 'sclassId': '40', 'subSclassId': '261', 'matchSeason': '2022-2023', 'round': '23', 'flesh': '0.6807624444063407', } response = requests.get('https://football.goaloo2.com/ajax/LeagueOddsAjax', params=params, headers=headers) print("请求状态码:", response.status_code) print("响应内容预览:", response.text[:500])
如果添加后返回正常的JSON格式内容,再调用response.json()即可解析。
3. 处理编码问题
如果响应文本是乱码,试试指定编码格式(国内体育网站常用GBK编码):
# 先尝试UTF-8编码 response.encoding = 'utf-8' print(response.text[:500]) # 如果还是乱码,切换为GBK编码 response.encoding = 'gbk' print(response.text[:500])
编码正确后,再尝试解析JSON。
4. 检查是否需要额外参数
如果以上方法都不行,回到Chrome的网络面板,查看原始请求的Headers,把Cookie、Referer等必要参数添加到请求头中——有些接口会验证请求的来源或会话信息。
内容的提问来源于stack exchange,提问作者eestlane
相关产品推荐
相关产品推荐

