You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Paddle OCR无法提取图片单个数字问题排查求助

Paddle OCR单个数字识别遗漏问题解决思路

你遇到的单个数字(如PACK SIZE后的4)识别遗漏,大概率不是操作错误,而是PaddleOCR默认模型对孤立小字符的检测局限性,同时可以通过参数调整和预处理优化来改善:

你的测试基础信息

所用代码

from paddleocr import PaddleOCR
import os

image_file = "3_496.png"

ocr = PaddleOCR(use_gpu=True)
image_path = os.path.join(os.getcwd(), image_file)
result = ocr.ocr(image_path, cls=True)

if None not in result:
    print(f"OCR result for {image_file}:")
    for line in result[0]:
        print(line[1][0])

测试图片

测试图片

当前识别输出

OCR result for 3_496.png: PAGLNILE. PIGRWGIGHT 400g DATCHNUMHERE USLOYI 205257 31/07/2024 12.22. CUTIN NZ

具体优化方案

  • 调整检测参数:孤立小数字容易因检测框阈值过高被过滤,修改det_db_box_thresh(降低至0.3左右)和det_db_unclip_ratio(提高至2.0左右),让模型更敏感捕捉小目标:
    ocr = PaddleOCR(use_gpu=True, det_db_box_thresh=0.3, det_db_unclip_ratio=2.0)
    
  • 关闭方向分类:若图片无方向颠倒情况,将cls=True改为cls=False,减少方向分类对小字符检测的干扰
  • 图片预处理:对输入图片做放大、对比度增强处理(比如用OpenCV将图片放大2倍),提升单个数字的像素占比,帮助模型识别
  • 更换/微调模型:若上述方法效果有限,可使用PaddleOCR针对小字符优化的预训练模型,或收集同类含单个数字的图片对默认模型进行微调,针对性提升该场景的识别率

内容的提问来源于stack exchange,提问作者S Andrew

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.20 13:02:36