如何在Docker部署的Paperless-ngx中重新执行指定文档的OCR?
重新执行Paperless-ngx指定文档的OCR操作方法
Web UI 操作方式
- 打开Paperless-ngx的Web管理界面,定位到需要重新OCR的目标文档
- 进入文档详情页,点击右上角的三点菜单,选择「重新处理文档」
- 在确认弹窗中勾选「强制重新执行OCR」选项,确认后即可触发该文档的OCR重新执行
Docker命令行操作方式
- 进入paperless-webserver容器的交互式shell:
docker exec -it paperless-webserver-1 /bin/bash - 在容器内使用管理命令重新处理指定文档(需替换
<文档ID>为实际ID,可从Web UI文档URL中获取,如/documents/123/的ID为123):
如需批量处理多个文档,可空格分隔多个ID:python manage.py document_reprocess --ocr <文档ID>python manage.py document_reprocess --ocr 123 456 789
关于PAPERLESS_OCR_MODE配置说明
- 该环境变量用于全局控制OCR执行策略,默认值为
skip(跳过已包含文本的文档);若需让所有新上传文档强制执行OCR,可设置为force - 在Docker部署场景下,需编辑
docker-compose.yml文件,在paperless-webserver服务的environment段添加:PAPERLESS_OCR_MODE=force - 配置修改后重启容器生效:
docker-compose up -d - 注意:此为全局配置,仅针对新上传文档生效;若仅需处理存量文档,优先使用前面的重新处理方法即可
内容的提问来源于stack exchange,提问作者KaO
相关产品推荐
相关产品推荐

