You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Oddsportal爬取Pinnacle赔率问题:悬停显示与Feed参数获取

Oddsportal爬取Pinnacle赔率问题解决方案

问题1:Selenium悬停代码报错的解决方法

你的代码报错大概率是因为绝对XPATH路径脆弱、元素未加载完成或悬停目标定位错误,以下是修正后的方案:

核心问题分析

  • 绝对XPATH依赖页面固定结构,页面更新后直接失效
  • 未等待元素加载就执行查找,触发NoSuchElementException
  • 悬停目标应该是包含Pinnacle的整行,而非直接定位赔率div

修正代码

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from selenium.webdriver.common.action_chains import ActionChains

# 初始化浏览器并打开目标页面
driver = webdriver.Chrome()
driver.get("https://www.oddsportal.com/football/russia/premier-league/spartak-moscow-akhmat-grozny-dI0Fo2oa/#1X2;2")

# 显式等待Pinnacle赔率行加载完成(最长等待10秒)
pinnacle_row = WebDriverWait(driver, 10).until(
    EC.presence_of_element_located((By.XPATH, "//div[contains(@class, 'table-main__row') and .//a[text()='Pinnacle']]"))
)

# 对整行执行悬停动作,触发赔率显示
hover = ActionChains(driver).move_to_element(pinnacle_row)
hover.perform()

# 提取悬停后显示的赔率
odds_elements = pinnacle_row.find_elements(By.CLASS_NAME, "table-main__odds")
for elem in odds_elements:
    print(f"Pinnacle赔率:{elem.text}")

driver.quit()

问题2:bs4+requests方案获取feed参数的方法

yj972这类参数是页面加载时通过JS生成的,可从目标页面的HTML脚本中提取:

核心思路

  • 先请求目标页面,解析HTML中的脚本标签
  • 用正则匹配包含赛事ID(dI0Fo2oa)的feed路径,提取末尾的随机参数

实现代码

import requests
from bs4 import BeautifulSoup
import re

# 请求头模拟浏览器,避免被反爬拦截
headers = {
    "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/114.0.0.0 Safari/537.36"
}

# 获取目标页面HTML
target_url = "https://www.oddsportal.com/football/russia/premier-league/spartak-moscow-akhmat-grozny-dI0Fo2oa/#1X2;2"
response = requests.get(target_url, headers=headers)
soup = BeautifulSoup(response.text, "html.parser")

# 遍历脚本标签,匹配feed参数
feed_param = None
for script in soup.find_all("script"):
    if script.string and "match-event" in script.string:
        # 正则匹配包含dI0Fo2oa的feed路径,提取末尾参数
        match_result = re.search(r'1-1-dI0Fo2oa-1-2-(\w+)', script.string)
        if match_result:
            feed_param = match_result.group(1)
            break

# 拼接feed URL并请求数据
if feed_param:
    feed_url = f"https://www.oddsportal.com/feed/match-event/1-1-dI0Fo2oa-1-2-{feed_param}.dat"
    feed_response = requests.get(feed_url, headers=headers)
    # feed数据多为压缩/结构化文本,需根据实际格式解析(可尝试转JSON或拆分字符串)
    print(feed_response.text)
else:
    print("未找到feed参数")

内容的提问来源于stack exchange,提问作者Khaled Koubaa

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.26 14:58:35