使用Pandas爬取网页表格仅获取3条数据,如何得到表格全部内容?
解决方法
你目前只能拿到3条数据是参数设置错误导致的,按以下步骤修改即可拿到全量表格:
- 移除
pd.read_html中的match='Augustow'和skiprows=2参数,这两个参数会限制pandas仅匹配包含指定字符串的局部表格,同时跳过有效数据行 - 不要调用
.head()方法,该方法默认仅返回数据框前5行数据,直接打印完整数据框即可查看全部内容 - 该页面共有2个HTML表格,索引为1的表格才是完整的波兰城市经纬度表,直接读取该表格即可
修正后的代码如下:
import pandas as pd import folium # 读取页面所有表格,设置第一行为表头 all_tables = pd.read_html("https://www.mapsofworld.com/lat_long/poland-lat-long.html", header=0) # 取第二个表格(索引从0开始)即全量经纬度表 coordinates = all_tables[1] # 打印全量数据 print(coordinates) # 可执行以下代码查看数据总条数验证 # print(f"总数据条数:{len(coordinates)}")
修改后可获取到全部200余条波兰城市的经纬度数据。
内容的提问来源于stack exchange,提问作者klixo
相关产品推荐
相关产品推荐

