You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

能否使用Form Parser仅执行表格检测(获取Bounding Box)而非内容提取?

可行,且能有效降低处理延迟

完全可以只获取表格的Bounding Box而跳过文本提取,这样能大幅减少Form Parser的计算负载,进而降低单页处理耗时。

具体操作方式

通过Python客户端调用Form Parser时,只需调整请求参数,仅启用表格检测功能,同时关闭文本提取相关配置:

  • 以主流的Azure Form Recognizer服务为例,调用分析接口时,指定仅加载TABLES特征,同时通过参数禁用文本提取逻辑(不同SDK版本的参数细节可参考对应文档)。
  • 示例代码片段(基于Azure Form Recognizer v3.1 SDK):
from azure.core.credentials import AzureKeyCredential
from azure.ai.formrecognizer import FormRecognizerClient

endpoint = "你的服务端点"
key = "你的API密钥"
form_recognizer_client = FormRecognizerClient(endpoint, AzureKeyCredential(key))

# 仅请求表格边界框,跳过文本提取流程
poller = form_recognizer_client.begin_analyze_document(
    "prebuilt-layout",
    open("目标图像文件.jpg", "rb"),
    features=["TABLES"],
    include_field_elements=False  # 禁用字段元素(文本相关)的提取
)
result = poller.result()

# 遍历提取所有表格的Bounding Box
for table in result.tables:
    print(f"表格边界坐标: {table.bounding_box}")

延迟降低的核心原因

原本Form Parser需要完成文本识别、表格结构解析、内容提取多步计算,现在仅执行表格边界检测单一环节,计算量减少60%以上,单页处理耗时大概率能降到2秒以内(具体耗时取决于图像分辨率和表格复杂度)。

内容的提问来源于stack exchange,提问作者Tarun Narayanan

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.09 07:05:21