You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用Amazon Textract获取文档倾斜角或禁用自动去倾斜功能?

请问是否可以让Amazon Textract返回其正在处理的PDF文档的倾斜角度?我在对扫描文档进行检测时发现,Textract会自动执行去倾斜操作,但计算结果存在小幅偏差。目前我无法找到获取每个LINE或WORD原始bounding box或几何信息的途径,返回的所有位置信息均对应去倾斜后的坐标。请问是否有其他方法可以获取文档倾斜角,或者是否可以在发送请求时禁用自动去倾斜功能?

解答

官方接口现状

  • Amazon Textract目前未提供返回文档倾斜角度的公开参数,也不支持通过请求配置禁用自动去倾斜逻辑
  • 接口返回的所有BoundingBox、Polygon等几何字段,均对应去倾斜校正后的图像坐标,不会返回原始扫描状态下的位置信息

可行替代方案

提前预处理计算倾斜角

在调用Textract之前,先将PDF逐页转换为图像,使用OpenCV等图像处理工具自行计算倾斜角度,常用实现逻辑包括:

  • 基于霍夫线变换识别文本行、文档边框等直线元素,计算整体偏转角度
  • 提取全页文本区域轮廓,计算轮廓最小外接矩形的偏转角度
    计算得到的倾斜角可自行留存,用于后续坐标映射

校正坐标反向转换

Textract的去倾斜属于刚性仿射变换,只要提前获取原始图像的倾斜角度,即可通过仿射变换公式,将Textract返回的校正后坐标转换回原始图像对应的坐标位置,无需依赖Textract返回原始几何信息

规则文档偏差修正

如果处理的是带表格、固定页眉页脚等结构化元素的文档,也可以通过Textract返回的表格、单元格等元素的坐标,反推校正偏差值,修正小范围的计算误差


内容的提问来源于stack exchange,提问作者bob

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.29 05:45:07