You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用Pandas爬取网页表格仅获取3条数据,如何得到表格全部内容?

解决方法

你目前只能拿到3条数据是参数设置错误导致的,按以下步骤修改即可拿到全量表格:

  • 移除pd.read_html中的match='Augustow'和skiprows=2参数,这两个参数会限制pandas仅匹配包含指定字符串的局部表格,同时跳过有效数据行
  • 不要调用.head()方法,该方法默认仅返回数据框前5行数据,直接打印完整数据框即可查看全部内容
  • 该页面共有2个HTML表格,索引为1的表格才是完整的波兰城市经纬度表,直接读取该表格即可

修正后的代码如下:

import pandas as pd
import folium

# 读取页面所有表格,设置第一行为表头
all_tables = pd.read_html("https://www.mapsofworld.com/lat_long/poland-lat-long.html", header=0)
# 取第二个表格(索引从0开始)即全量经纬度表
coordinates = all_tables[1]

# 打印全量数据
print(coordinates)
# 可执行以下代码查看数据总条数验证
# print(f"总数据条数:{len(coordinates)}")

修改后可获取到全部200余条波兰城市的经纬度数据。

内容的提问来源于stack exchange,提问作者klixo

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.27 11:54:02