You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

为何GCP Vision API在Python中返回的结果不如在线演示?

基于GCP Vision API的产品包装盒品牌识别脚本

我刚写了个基础Python脚本,核心功能是调用GCP Vision API识别产品包装盒上的文字,再从识别结果里匹配我预设好的品牌列表。先贴出脚本代码:

import io
from google.cloud import vision
from google.cloud.vision import types
import os
import cv2
import numpy as np

os.environ["GOOGLE_APPLICATION_CREDENTIALS"] = "*****"

简单说下这个脚本的关键点:

  • 依赖google-cloud-vision库调用GCP的OCR服务,得提前用pip install google-cloud-vision opencv-python numpy装好所有依赖
  • 用os.environ配置GCP认证凭据,把代码里的*****替换成你自己的服务账号密钥文件路径就行
  • 导入cv2和numpy是留着做图片预处理用的,比如裁剪包装盒区域、调整图片清晰度,后续可以补上这部分逻辑
  • 后续还需要补充的核心逻辑:读取本地图片文件、调用Vision API的文本检测接口、把识别出的文本和预设品牌列表做比对(比如用in关键字判断品牌是否出现在识别文本里)

内容的提问来源于stack exchange,提问作者Outcast

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.26 09:59:05