使用Pandas获取网页完整表格并导出为Excel的问题求助
Pandas获取网页完整表格并导出为Excel的问题求助
我正尝试从目标网站下载表格,但球队名称中嵌入的链接以及页面里的次级表格导致表格下载出现异常。我的核心需求是获取页面上的完整表格,可由于球队名称字段里嵌套了次级表格,一直没法成功实现。请问我该怎么获取这个页面的完整表格并将其导出为Excel电子表格?
我的代码1:
import requests import pandas as pd from io import StringIO from bs4 import BeautifulSoup import lxml import xlsxwriter import openpyxl as op url = 'https://footystats.org/england/premier-league/form-table' header = { "User-Agent": "Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/50.0.2661.75 Safari/537.36", "X-Requested-With": "XMLHttpRequest" } r = requests.get(url, headers=header) data1 = pd.read_html(StringIO(r.text), skiprows=0, header=0)[41] print(data1) writer = pd.ExcelWriter('data.xlsx', engine='xlsxwriter') data1.to_excel(writer) writer._save()
(代码1运行结果未提供详细内容)
我的代码2:
import requests import pandas as pd from io import StringIO from bs4 import BeautifulSoup import lxml import xlsxwriter url = 'https://footystats.org/england/premier-league/form-table' header = { "User-Agent": "Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/50.0.2661.75 Safari/537.36", "X-Requested-With": "XMLHttpRequest" } r = requests.get(url, headers=header) dfs = pd.read_html(StringIO(r.text)) am=len(dfs) df =dfs[41] print(df) writer = pd.ExcelWriter('data.xls', engine='xlsxwriter') df.to_excel(writer) writer._save()
(代码2运行结果未提供详细内容)
备注:内容来源于stack exchange,提问作者Murat
相关产品推荐
相关产品推荐

