You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Jupyter Notebook中调用pd.read_html触发ImportError的问题求助

解决pd.read_html的ImportError问题

pd.read_html() 依赖额外的HTML解析库(lxml、html5lib或beautifulsoup4),即便pandas本身运行正常,缺少这些依赖也会触发ImportError。以下是具体解决步骤:

  • 安装缺失的解析库
    优先安装性能最优的lxml:

    pip install lxml
    

    若lxml安装失败,可替换为html5lib和beautifulsoup4:

    pip install html5lib beautifulsoup4
    
  • 验证安装后重新执行代码
    安装完成后,在Notebook中重新运行:

    import pandas as pd
    DataUFC = pd.read_html('https://en.wikipedia.org/wiki/List_of_UFC_events')
    # 页面可能包含多个表格,可查看提取数量
    print(f"共提取到{len(DataUFC)}个表格")
    # 示例:取第一个表格查看
    df = DataUFC[0]
    df.head()
    
  • 额外适配方案
    如果你使用conda环境,用conda安装兼容性更好:

    conda install lxml
    # 或
    conda install html5lib beautifulsoup4
    

    若仍有问题,尝试更新pandas到兼容版本:

    pip install --upgrade pandas
    

内容的提问来源于stack exchange,提问作者Stephanie

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.22 22:42:00