如何配置Document AI API使其仅返回训练得到的实体信息?
关于Document AI API仅返回实体信息的解决方案
目前Google Cloud Document AI没有提供直接配置API仅返回实体信息的选项,不过你可以通过以下两种方式获取仅需要的实体数据:
客户端本地过滤结果:调用API获取完整响应后,直接解析并提取响应中的实体字段即可。比如在Python中,你可以从返回的响应对象里直接取出
document.entities部分,丢弃其他无关内容,示例代码如下:# 假设response是API返回的完整响应对象 target_entities = response.document.entities # 后续仅使用target_entities进行业务处理批量处理场景下的后处理:如果是使用批量处理功能,作业完成后会生成包含完整文档信息的输出文件,你可以编写脚本遍历这些文件,只提取其中的实体数据并保存,过滤掉其他内容。
这种客户端过滤的方式成本很低,因为Document AI返回的实体结构清晰,提取逻辑简单,完全可以满足你的需求。
内容的提问来源于stack exchange,提问作者Carlos Daniel Ospina Salazar
相关产品推荐
相关产品推荐

