在Azure Databricks中使用Form Recognizer遇无效错误及无输出求助
解决Azure Databricks中使用Form Recognizer的无效错误及无输出问题
检查文件访问权限与路径
确保Databricks中访问的文件(图片/PDF)路径正确,集群拥有读取权限。若是DBFS路径,需使用dbfs:/前缀,比如dbfs:/mnt/your-container/your-file.pdf;本地上传文件要确认已挂载到DBFS。另外,文件不能是密码保护状态,Form Recognizer不支持加密文档。验证Form Recognizer服务配置
确认Form Recognizer的密钥、终结点正确且未过期。在Databricks中调用时,建议使用最新版azure-ai-formrecognizer包,可运行以下命令安装或更新:%pip install --upgrade azure-ai-formrecognizer调试请求内容
先简化代码,用公开示例文件测试服务是否正常响应。示例代码如下:from azure.ai.formrecognizer import DocumentAnalysisClient from azure.core.credentials import AzureKeyCredential endpoint = "你的Form Recognizer终结点" key = "你的密钥" document_analysis_client = DocumentAnalysisClient( endpoint=endpoint, credential=AzureKeyCredential(key) ) # 用公开示例URL测试 sample_url = "https://raw.githubusercontent.com/Azure-Samples/cognitive-services-REST-api-samples/master/curl/form-recognizer/sample-invoice.pdf" poller = document_analysis_client.begin_analyze_document_from_url("prebuilt-invoice", sample_url) result = poller.result() print("分析结果:") for idx, invoice in enumerate(result.documents): print(f"发票 #{idx + 1}") print(f"发票总金额: {invoice.fields.get('Total').value if invoice.fields.get('Total') else 'N/A'}")若这段代码能正常输出,说明服务配置无问题,故障出在你自己的文件上。
排查文件格式与大小
Form Recognizer支持PDF、JPG、PNG、TIFF等格式,需确保文件格式符合要求。同时单个文件大小不能超过50MB,页面数不超过200页,过大的文件可尝试压缩或拆分后再测试。检查Databricks网络配置
若Form Recognizer服务设置了虚拟网络(VNet),要确认Databricks集群所在网络能访问该VNet,或Form Recognizer允许公网访问。可在Databricks中测试能否连通Form Recognizer终结点,或用requests库发送简单请求验证网络状态。
内容的提问来源于stack exchange,提问作者Naga Venkatesh
相关产品推荐
相关产品推荐

