You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

通过Azure Data Factory V2在HDInsight集群提交Spark活动报错求助

解决HDInsight集群上ADF V2提交Spark活动的两类报错

我帮你梳理下这两个常见问题的排查和解决思路:

一、搞定__spark_conf__.zip:没有该文件或目录的问题

这个报错一般是ADF提交Spark作业时,没法正常生成或访问Spark配置压缩包导致的,你可以试试这些操作:

  • 先检查ADF里的Spark活动配置,确认关联的HDInsight集群链接服务配置没问题——比如存储账户的密钥是否有效,集群的访问权限有没有配置到位。
  • 登录HDInsight集群的头节点,检查wasb存储容器的挂载路径能不能正常访问,要是存储挂载失败也会引发这个问题。
  • 要是你自定义了Spark配置,先暂时去掉自定义项试试,避免配置冲突;如果必须保留,要确保所有路径参数都是有效的wasb或abfs格式。

二、解决AM容器退出码-1000的应用失败问题

退出码-1000大多和资源不够、存储访问异常或者配置冲突有关,从这几个方向排查:

资源排查

  • 打开集群的YARN控制台看看资源使用情况,要是集群节点的内存、CPU都被占满了,AM容器拿不到足够资源就会直接退出。这种情况要么扩容集群,要么调整作业的资源请求参数,比如spark.driver.memory、spark.executor.memory这些,别让作业请求的资源超过集群能提供的上限。

存储与配置排查

  • 结合报错里提到的wasb诊断信息,检查作业用的存储容器权限——ADF的服务主体有没有这个容器的读写权限很关键。
  • 去YARN UI里找到对应应用的尝试日志,重点看有没有存储访问超时、文件找不到或者权限被拒的详细报错,这些都是AM启动失败的常见诱因。
  • 要是作业用到了依赖包,确认这些包放在了正确的存储路径下,而且ADF和HDInsight集群都能正常访问这个路径。

内容的提问来源于stack exchange,提问作者Deepak Rawat

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.25 07:42:49