如何在Microsoft Power Automate中通过Base64或图片链接实现OCR?
技术方案:Power Automate 扩展OCR支持数据库图片链接/Base64及动态呈现
一、核心功能扩展:处理数据库图片链接/Base64
1. 数据库图片链接处理流程
- 从目标数据库(SQL Server、Dataverse等)读取存储的图片URL字段
- 使用
HTTP动作发送GET请求获取图片二进制内容:- 配置请求URL为数据库返回的链接,请求方法设为
GET,开启二进制输出选项
- 配置请求URL为数据库返回的链接,请求方法设为
- 将获取到的二进制数据直接传入OCR动作(如
Azure AI Document Intelligence或OneNote OCR)执行识别
2. Base64格式处理流程
- 从数据库读取Base64编码字符串,先清理前缀(如
data:image/png;base64,这类标识) - 使用
Base64 to Binary内置动作将清理后的编码字符串转换为二进制文件 - 将转换后的二进制文件传入OCR动作完成文本识别
二、动态化呈现实现
1. 实时交互场景(适配Power Apps嵌入)
- 创建手动触发流,设置输入参数为「图片链接/Base64字符串」
- OCR识别完成后,返回结构化结果:包含识别文本、原图片预览数据
- 在Power Apps中调用该流,通过
Gallery控件绑定返回结果,实现输入-识别-展示的实时联动
2. 自动化场景的动态反馈
- 添加
Condition动作判断OCR识别状态:- 识别成功时,将结果写入数据库对应字段,同时用
Send an email (V2)推送带格式化文本的通知 - 识别失败时,返回明确错误提示,并将错误日志写入数据库
- 识别成功时,将结果写入数据库对应字段,同时用
- 使用
Compose动作格式化识别结果,添加换行、分段标记,提升输出文本可读性
三、关键注意事项
- 数据库存储的图片链接需确保公网可访问,内网链接需配置Power Automate网关打通访问权限
- Base64字符串必须清理无效前缀,否则会导致二进制转换失败
- 优先选用
Azure AI Document Intelligence作为OCR工具,支持多语种、复杂排版,识别准确率更高
内容的提问来源于stack exchange,提问作者Darshan Dholakiya
相关产品推荐
相关产品推荐

