You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何修复Python调用pytesseract提取图片文本时的TesseractError报错

报错核心原因

你给pytesseract.pytesseract.tesseract_cmd指定的路径是Python pytesseract依赖包的入口程序,不是真正的Tesseract OCR引擎可执行文件,调用时参数规则不匹配,所以抛出了用法错误。

修复步骤
  • 第一步:安装官方Tesseract OCR引擎
    pytesseract只是Python封装的调用工具,本身不带OCR识别能力,需要先安装Tesseract官方原生程序,安装时记住你选择的安装路径。
  • 第二步:修正tesseract_cmd的指向路径
    把代码中原有的错误路径配置:
pytesseract.pytesseract.tesseract_cmd = 'D:\\python\\venv\\Scripts\\pytesseract.exe'

替换为你实际安装Tesseract OCR引擎的路径,示例如下:

# 路径前加r可以避免手动转义反斜杠
pytesseract.pytesseract.tesseract_cmd = r'C:\Program Files\Tesseract-OCR\tesseract.exe'
  • 第三步:优化调用参数(可选)
    建议给lang参数指定明确的识别语言,不要传None,比如识别英文填eng、识别简体中文填chi_sim;也可以加--psm 6参数指定把图像当成单块统一文本识别,提升常规场景识别准确率:
text = pytesseract.image_to_string(img, lang='eng', config='--psm 6')
验证效果

修改完成后重新运行代码,即可正常识别图片文本,输出结果同时保存到和图片同名的txt文件中。

内容的提问来源于stack exchange,提问作者shiham

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.25 20:54:08