You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Microsoft Power Automate中通过Base64或图片链接实现OCR?

技术方案:Power Automate 扩展OCR支持数据库图片链接/Base64及动态呈现

一、核心功能扩展:处理数据库图片链接/Base64

1. 数据库图片链接处理流程

  • 从目标数据库(SQL Server、Dataverse等)读取存储的图片URL字段
  • 使用HTTP动作发送GET请求获取图片二进制内容:
    • 配置请求URL为数据库返回的链接,请求方法设为GET,开启二进制输出选项
  • 将获取到的二进制数据直接传入OCR动作(如Azure AI Document Intelligence或OneNote OCR)执行识别

2. Base64格式处理流程

  • 从数据库读取Base64编码字符串,先清理前缀(如data:image/png;base64,这类标识)
  • 使用Base64 to Binary内置动作将清理后的编码字符串转换为二进制文件
  • 将转换后的二进制文件传入OCR动作完成文本识别

二、动态化呈现实现

1. 实时交互场景(适配Power Apps嵌入)

  • 创建手动触发流,设置输入参数为「图片链接/Base64字符串」
  • OCR识别完成后,返回结构化结果:包含识别文本、原图片预览数据
  • 在Power Apps中调用该流,通过Gallery控件绑定返回结果,实现输入-识别-展示的实时联动

2. 自动化场景的动态反馈

  • 添加Condition动作判断OCR识别状态:
    • 识别成功时,将结果写入数据库对应字段,同时用Send an email (V2)推送带格式化文本的通知
    • 识别失败时,返回明确错误提示,并将错误日志写入数据库
  • 使用Compose动作格式化识别结果,添加换行、分段标记,提升输出文本可读性

三、关键注意事项

  • 数据库存储的图片链接需确保公网可访问,内网链接需配置Power Automate网关打通访问权限
  • Base64字符串必须清理无效前缀,否则会导致二进制转换失败
  • 优先选用Azure AI Document Intelligence作为OCR工具,支持多语种、复杂排版,识别准确率更高

内容的提问来源于stack exchange,提问作者Darshan Dholakiya

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.26 13:02:40