如何获取Amazon Textract call_textract_lending除PAYSLIPS&CHECKS外的分类输出列表?
Amazon Textract贷款文档页面分类完整列表获取方法
直接通过boto3枚举查看
你可以通过Python代码直接调用boto3的Textract服务模型,获取官方定义的PageType枚举值,这是最准确的方式:
import boto3 textract_client = boto3.client('textract') # 获取服务模型中的PageType枚举定义 service_model = textract_client._service_model page_type_enums = service_model.shape_for('PageType').enum for page_type in page_type_enums: print(page_type)
运行这段代码会输出Textract贷款文档处理支持的所有页面分类类型。
测试多类型文档包收集结果
构造一个包含多种贷款相关文档的测试PDF(比如包含W2表格、银行对账单、贷款申请表、身份证明、抵押声明等),用你现有的代码调用call_textract_lending,遍历结果收集所有不同的PageClassification.PageType值,能得到实际可识别的分类列表。
常见的其他分类类型
根据实际使用场景,除了PAYSLIPS和CHECKS,还会遇到这些分类:
- W2:薪资税务声明表格
- BANK_STATEMENTS:银行对账单
- LOAN_APPLICATIONS:贷款申请页
- IDENTIFICATION_DOCUMENTS:身份证明文件(驾照、护照等)
- MORTGAGE_STATEMENTS:抵押声明
- INVESTMENT_STATEMENTS:投资账户对账单
- UTILITY_BILLS:公用事业账单
内容的提问来源于stack exchange,提问作者Lichia Reghu
相关产品推荐
相关产品推荐

