You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python使用requests爬取Seeking Alpha股票返回HTML无实际股价字段问题

你当前的问题不是req.get()方法遗漏必要参数导致的。Seeking Alpha站点的实时股价类业务数据为前端JavaScript异步加载渲染,初始返回的静态HTML骨架中本身就不包含这部分数据,所以你无法直接从req.get()返回的内容中解析到目标数据。

问题根因

  • 这类金融数据站点的高频更新数据(实时股价、交易量等)不会嵌入初始HTML源码,而是页面加载完成后,由浏览器通过异步请求拉取JSON格式的数据,再动态插入到页面DOM节点中,requests库只能拿到初始静态HTML,不会执行JS逻辑,因此拿不到动态渲染的数据。

可行解决方案

方案1:抓异步接口(效率更高,推荐)

打开浏览器开发者工具的「网络」面板,筛选「Fetch/XHR」类请求,刷新页面后找到返回股价数据的后端接口,直接请求该接口获取结构化的JSON数据即可。
注意:这类接口一般会有鉴权校验,你需要把浏览器请求该接口时携带的Referer、Cookie、自定义鉴权头等参数补充到你代码的headers字典中,即可正常拿到返回数据。

方案2:无头浏览器模拟渲染(适配复杂鉴权场景)

如果接口鉴权逻辑复杂难以模拟,可以使用Selenium、Playwright这类无头浏览器工具,模拟真实浏览器加载页面,等待JS执行完成、数据渲染到页面后再提取对应节点内容,示例代码如下:

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC

# 初始化Chrome浏览器,也可以配置无头模式不弹出窗口
driver = webdriver.Chrome()
driver.get("https://seekingalpha.com/symbol/AAPL")
# 等待股价节点加载完成,需要替换为实际的股价节点CSS选择器
price_element = WebDriverWait(driver, 10).until(
    EC.presence_of_element_located((By.CSS_SELECTOR, ".sym-common-price")) # 选择器可在浏览器元素面板中复制
)
print("AAPL当前股价:", price_element.text)
driver.quit()

额外注意事项

  • 站点存在反爬策略,频繁请求可能会被限制IP,建议合理控制请求间隔,必要时可搭配代理池使用。
  • 抓取数据前请确认站点的爬取规则,避免违反用户协议。

内容的提问来源于stack exchange,提问作者Rajat Mitra

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.26 00:24:00