Jupyter Notebook中调用pd.read_html触发ImportError的问题求助
解决pd.read_html的ImportError问题
pd.read_html() 依赖额外的HTML解析库(lxml、html5lib或beautifulsoup4),即便pandas本身运行正常,缺少这些依赖也会触发ImportError。以下是具体解决步骤:
安装缺失的解析库
优先安装性能最优的lxml:pip install lxml若lxml安装失败,可替换为html5lib和beautifulsoup4:
pip install html5lib beautifulsoup4验证安装后重新执行代码
安装完成后,在Notebook中重新运行:import pandas as pd DataUFC = pd.read_html('https://en.wikipedia.org/wiki/List_of_UFC_events') # 页面可能包含多个表格,可查看提取数量 print(f"共提取到{len(DataUFC)}个表格") # 示例:取第一个表格查看 df = DataUFC[0] df.head()额外适配方案
如果你使用conda环境,用conda安装兼容性更好:conda install lxml # 或 conda install html5lib beautifulsoup4若仍有问题,尝试更新pandas到兼容版本:
pip install --upgrade pandas
内容的提问来源于stack exchange,提问作者Stephanie
相关产品推荐
相关产品推荐

