使用Python PDFMiner提取PDF文本时遭遇ImportError错误求助
解决PDFMiner中
extract_pages导入错误的方案 看起来你遇到的问题源于PDFMiner的版本兼容性——extract_pages是较新的pdfminer.six版本才添加到high_level模块的功能,旧版本的包中并没有这个方法。下面是具体的解决步骤:
1. 确认安装的是维护版pdfminer.six而非旧版pdfminer
现在主流维护的PDFMiner分支是pdfminer.six,原始的pdfminer包已经停止更新了。先检查当前安装的包:
pip show pdfminer.six
如果提示找不到该包,说明你装的是旧版,先卸载旧包:
pip uninstall pdfminer
再安装官方维护的分支:
pip install pdfminer.six
2. 升级到最新版pdfminer.six
即使已经装了pdfminer.six,版本过旧也会缺失extract_pages方法。执行升级命令:
pip install --upgrade pdfminer.six
3. 核对代码中的导入语句
另外注意,错误回溯里提到的是导入extract_pages,但你提供的脚本里用的是extract_text——检查代码中是否有其他地方调用了extract_pages,确保导入语句正确:
# 新版pdfminer.six的正确导入方式 from pdfminer.high_level import extract_text, extract_pages
完成以上步骤后重新运行脚本,应该就能解决这个导入错误了。
内容的提问来源于stack exchange,提问作者willian12345
相关产品推荐
相关产品推荐

