You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Vision API新版OCR本地与Azure VM识别结果不一致求助

Google Vision API 新版OCR环境差异问题

我在使用2024年2月19日将成为默认版本的Vision API Text Detection和Document Text Detection(OCR)新版时遇到异常:同一项目、同一图片文件,本地运行能得到正确识别结果,但在Azure虚拟机中运行的结果存在错误差异。查遍官方文档也没找到环境配置会影响识别结果的相关说明。

我使用的是ImageAnnotatorClient/AnnotateImageRequest,核心代码如下:

Builder builder = Feature.newBuilder();
builder.setModel("builtin/latest");
builder.setType(typeDetect); // Feature.Type.TEXT_DETECTION or Feature.Type.DOCUMENT_TEXT_DETECTION
Feature feat = builder.build();

使用当前默认的builtin/stable版本时不存在此问题,具体错误对比如下:

  • 本地(正确):-1.898,37;VM(错误):-1.898.37(逗号被误识别为点)
  • 本地(正确):2.340,772 24.703,952 30;VM(错误):2.340,772 24.703,952 w(数字30被误识别为字母w)
  • 本地(正确):2.290,092 23.857,148 31;VM(错误):2.290,092 23.857,148 w(数字31被误识别为字母w)

我尝试过以下解决方法,但均无效:

  • 发送"Hints"参数
  • 将检测类型设置为DOCUMENT_TEXT_DETECTION
  • 仅在美国区域处理请求

内容的提问来源于stack exchange,提问作者alexandreac

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.30 18:34:59