Azure Form Recognizer v2至v3过渡相关问题咨询
Form Recognizer 版本适配问题咨询
v2.1版本测试情况
Form Recognizer(FR)v3.0目前仍处于预览阶段,先参考v2.1版本快速入门文档中「使用预构建模型分析」章节指引,访问Form Recognizer示例工具,选择Form Type为*Invoice(发票)*对不同尺寸、包含印刷文本及手写内容的文档进行测试,返回结果符合预期,返回的JSON结构如下:
... "analyzeResult": { ... readResults:[...], pageResults:[...] ... }
不同场景适配逻辑如下:
- 针对大型/复杂图像/文档,可基于
rowIndex和columnIndex通过pageResults.tables[0].cells拼接行文本还原完整文档 - 针对小型/简单图像/文档或
pageResults.tables.length == 0的场景,可通过readResults.lines获取同等OCR识别结果,适配性表现良好
v3版本测试遇到的问题
使用相同测试图像参考JavaScript示例代码实操,因仅使用发票识别能力,选取了recognizeInvoice.js示例,该示例为v3版本实现,缺失readResults和pageResults字段:
- 大型/复杂图像/文档可通过
invoice.pages[0].tables[0].cells实现同等效果 - 小型/简单图像场景下存在两个问题:
invoice.pages[0].tables.length = 0,无文本返回- 仅返回
invoice.fields.VendorName.value对应的文本值NRT LLC.,v2.1版本可正常返回的其他印刷文本、手写内容均缺失
上述变化意味着v3版本不具备向后兼容性,且无法在提交请求前判断图像是否适配模型、是否能返回有效结果,即便向用户提供多模型选择也会带来额外人工操作成本,影响使用体验,目前暂时切换到其他厂商的同类服务。
待咨询问题
- v2.x版本的示例代码可从哪里获取,微软计划何时停止对v2.x版本的支持?
- v2.x版本如何迁移到v3版本?
以下为操作导航路径截图供参考:
内容的提问来源于stack exchange,提问作者Jeb50
相关产品推荐
相关产品推荐

