如何使用Amazon Textract获取文档倾斜角或禁用自动去倾斜功能?
请问是否可以让Amazon Textract返回其正在处理的PDF文档的倾斜角度?我在对扫描文档进行检测时发现,Textract会自动执行去倾斜操作,但计算结果存在小幅偏差。目前我无法找到获取每个LINE或WORD原始bounding box或几何信息的途径,返回的所有位置信息均对应去倾斜后的坐标。请问是否有其他方法可以获取文档倾斜角,或者是否可以在发送请求时禁用自动去倾斜功能?
解答
官方接口现状
- Amazon Textract目前未提供返回文档倾斜角度的公开参数,也不支持通过请求配置禁用自动去倾斜逻辑
- 接口返回的所有
BoundingBox、Polygon等几何字段,均对应去倾斜校正后的图像坐标,不会返回原始扫描状态下的位置信息
可行替代方案
提前预处理计算倾斜角
在调用Textract之前,先将PDF逐页转换为图像,使用OpenCV等图像处理工具自行计算倾斜角度,常用实现逻辑包括:
- 基于霍夫线变换识别文本行、文档边框等直线元素,计算整体偏转角度
- 提取全页文本区域轮廓,计算轮廓最小外接矩形的偏转角度
计算得到的倾斜角可自行留存,用于后续坐标映射
校正坐标反向转换
Textract的去倾斜属于刚性仿射变换,只要提前获取原始图像的倾斜角度,即可通过仿射变换公式,将Textract返回的校正后坐标转换回原始图像对应的坐标位置,无需依赖Textract返回原始几何信息
规则文档偏差修正
如果处理的是带表格、固定页眉页脚等结构化元素的文档,也可以通过Textract返回的表格、单元格等元素的坐标,反推校正偏差值,修正小范围的计算误差
内容的提问来源于stack exchange,提问作者bob
相关产品推荐
相关产品推荐

