使用tabula将PDF转Excel时报错无法从'tabula'导入'read_pdf'如何解决
报错原因
该报错核心有两个诱因:
- 依赖包安装错误:你安装的是名为
tabula的无关第三方库,可实现PDF表格提取的官方Python库名称为tabula-py,二者不属于同一个项目 - 代码存在语法及参数使用错误
解决步骤
第一步:卸载错误安装的
tabula库
执行终端命令:pip uninstall tabula -y第二步:安装正确的依赖库
执行终端命令:pip install tabula-py第三步:确认本地已配置Java 8及以上版本的运行环境,
tabula-py底层依赖Java实现PDF解析逻辑,缺少Java环境会触发后续运行报错。第四步:修正代码逻辑,调整后可运行代码如下:
from tabula import read_pdf # 已单独导入read_pdf方法,无需再通过tabula前缀调用,原参数page改为官方要求的pages data = read_pdf("CX.pdf", pages="all") print(data) # 如需直接导出为Excel可放开下方注释 # import pandas as pd # with pd.ExcelWriter("CX转换结果.xlsx") as writer: # for index, table_df in enumerate(data): # table_df.to_excel(writer, sheet_name=f"第{index+1}页表格", index=False)
内容的提问来源于stack exchange,提问作者Amen Aziz
相关产品推荐
相关产品推荐

