You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用Pandas获取网页完整表格并导出为Excel的问题求助

Pandas获取网页完整表格并导出为Excel的问题求助

我正尝试从目标网站下载表格,但球队名称中嵌入的链接以及页面里的次级表格导致表格下载出现异常。我的核心需求是获取页面上的完整表格,可由于球队名称字段里嵌套了次级表格,一直没法成功实现。请问我该怎么获取这个页面的完整表格并将其导出为Excel电子表格?


我的代码1:

import requests
import pandas as pd
from io import StringIO
from bs4 import BeautifulSoup
import lxml
import xlsxwriter
import openpyxl as op

url = 'https://footystats.org/england/premier-league/form-table'

header = {
    "User-Agent": "Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/50.0.2661.75 Safari/537.36",
    "X-Requested-With": "XMLHttpRequest"
}

r = requests.get(url, headers=header)
data1 = pd.read_html(StringIO(r.text), skiprows=0, header=0)[41]
print(data1)

writer = pd.ExcelWriter('data.xlsx', engine='xlsxwriter')
data1.to_excel(writer)
writer._save()

(代码1运行结果未提供详细内容)


我的代码2:

import requests
import pandas as pd
from io import StringIO
from bs4 import BeautifulSoup
import lxml
import xlsxwriter

url = 'https://footystats.org/england/premier-league/form-table'

header = {
    "User-Agent": "Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/50.0.2661.75 Safari/537.36",
    "X-Requested-With": "XMLHttpRequest"
}

r = requests.get(url, headers=header)
dfs = pd.read_html(StringIO(r.text))
am=len(dfs)
df =dfs[41]
print(df)

writer = pd.ExcelWriter('data.xls', engine='xlsxwriter')
df.to_excel(writer)
writer._save()

(代码2运行结果未提供详细内容)


备注:内容来源于stack exchange,提问作者Murat

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.04.20 06:10:31