You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用tabula将PDF转Excel时报错无法从'tabula'导入'read_pdf'如何解决

报错原因

该报错核心有两个诱因:

  • 依赖包安装错误:你安装的是名为tabula的无关第三方库,可实现PDF表格提取的官方Python库名称为tabula-py,二者不属于同一个项目
  • 代码存在语法及参数使用错误
解决步骤
  • 第一步:卸载错误安装的tabula库
    执行终端命令:
    pip uninstall tabula -y

  • 第二步:安装正确的依赖库
    执行终端命令:
    pip install tabula-py

  • 第三步:确认本地已配置Java 8及以上版本的运行环境,tabula-py底层依赖Java实现PDF解析逻辑,缺少Java环境会触发后续运行报错。

  • 第四步:修正代码逻辑,调整后可运行代码如下:

from tabula import read_pdf
# 已单独导入read_pdf方法,无需再通过tabula前缀调用,原参数page改为官方要求的pages
data = read_pdf("CX.pdf", pages="all")
print(data)

# 如需直接导出为Excel可放开下方注释
# import pandas as pd
# with pd.ExcelWriter("CX转换结果.xlsx") as writer:
#     for index, table_df in enumerate(data):
#         table_df.to_excel(writer, sheet_name=f"第{index+1}页表格", index=False)

内容的提问来源于stack exchange,提问作者Amen Aziz

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.27 22:36:04