如何获取维基百科多表格并导出为CSV?解决AttributeError问题
问题解决:从维基百科提取Linux发行版表格并导出多CSV
错误原因
pd.read_html() 读取网页后返回的是DataFrame对象的列表,而非单个DataFrame。你直接将列表赋值给df后调用to_csv(),自然会触发AttributeError——列表没有这个方法。
解决方案
遍历返回的表格列表,将每个表格单独导出为CSV文件,用序号区分不同表格即可。代码如下:
import pandas as pd url = 'https://en.wikipedia.org/wiki/List_of_Linux_distributions' tables = pd.read_html(url) # 遍历表格列表,逐个导出为CSV for idx, table in enumerate(tables, start=1): # 生成带序号的文件名,避免覆盖 table.to_csv(f"linux_distros_{idx}.csv", sep=",", index=False)
补充说明
- 用
enumerate给表格加序号,确保每个文件有唯一名称 - 添加
index=False可以避免把DataFrame的索引列写入CSV,让输出内容更简洁 - 维基百科该页面包含多个结构不同的表格,分开导出比强行合并更实用
内容的提问来源于stack exchange,提问作者marreco
相关产品推荐
相关产品推荐

