You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Docker部署的Paperless-ngx中重新执行指定文档的OCR?

重新执行Paperless-ngx指定文档的OCR操作方法

Web UI 操作方式

  • 打开Paperless-ngx的Web管理界面,定位到需要重新OCR的目标文档
  • 进入文档详情页,点击右上角的三点菜单,选择「重新处理文档」
  • 在确认弹窗中勾选「强制重新执行OCR」选项,确认后即可触发该文档的OCR重新执行

Docker命令行操作方式

  • 进入paperless-webserver容器的交互式shell:
    docker exec -it paperless-webserver-1 /bin/bash
    
  • 在容器内使用管理命令重新处理指定文档(需替换<文档ID>为实际ID,可从Web UI文档URL中获取,如/documents/123/的ID为123):
    python manage.py document_reprocess --ocr <文档ID>
    
    如需批量处理多个文档,可空格分隔多个ID:
    python manage.py document_reprocess --ocr 123 456 789
    

关于PAPERLESS_OCR_MODE配置说明

  • 该环境变量用于全局控制OCR执行策略,默认值为skip(跳过已包含文本的文档);若需让所有新上传文档强制执行OCR,可设置为force
  • 在Docker部署场景下,需编辑docker-compose.yml文件,在paperless-webserver服务的environment段添加:
    PAPERLESS_OCR_MODE=force
    
  • 配置修改后重启容器生效:
    docker-compose up -d
    
  • 注意:此为全局配置,仅针对新上传文档生效;若仅需处理存量文档,优先使用前面的重新处理方法即可

内容的提问来源于stack exchange,提问作者KaO

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.27 01:20:02