AI Builder Form Recognizer处理StreamServe XFA PDF报错(0x80048d0f)
Power Automate中AI Builder Form Recognizer处理StreamServe生成PDF发票的问题
在Power Automate中使用AI Builder的Form Recognizer处理由StreamServe Communication Server生成的单页PDF发票时,约15分钟后会抛出以下错误:
{ "statusCode": 502, "body": { "error": { "code": "0x80048d0f", "message": "{\"operationStatus\":\"Error\",\"error\":{\"type\":\"Error\",\"code\":\"DependencyFailure\",\"message\":\"Object reference not set to an instance of an object.\",\"properties\":{\"BackendErrorCode\":\"InternalServerError\",\"DependencyHttpStatusCode\":\"500\"}}}" } } }
已执行的排查操作:
- 确认该PDF文件大小低于20MB,尺寸为标准A4(595 × 842 pt)
- 重新保存流以获取60分钟超时权限,并添加了重试逻辑
- 切换至预构建发票处理模型后,功能可正常运行
- 使用自定义模型时,导入该发票进行训练,无法检测到任何字段内容
问题分析与解决建议
- PDF格式兼容性问题:StreamServe生成的PDF可能包含特殊内部结构(如非标准字体、自定义渲染逻辑),导致自定义模型解析失败甚至触发后端空引用错误。预构建模型兼容性优化更充分,因此能正常处理。
- 自定义模型训练样本缺失:若训练自定义模型时未纳入同类型StreamServe发票样本,模型无法识别这类发票的字段模式。建议收集多份该类型发票,手动标注字段后重新训练。
- 后端服务适配bug:错误中的
InternalServerError和空引用提示,可能是Form Recognizer后端处理该特定PDF时的问题。可尝试将PDF转换为PNG/JPG图片格式后传入自定义模型,绕过PDF解析环节;也可向微软提交工单,提供该PDF文件协助排查后端bug。
内容的提问来源于stack exchange,提问作者Majid Alashari
相关产品推荐
相关产品推荐

