如何在Databricks全局初始化脚本中安装Maven库(DBR7+替代弃用方案)
使用全局初始化脚本为Databricks所有集群安装Maven库(DBR 7+)
步骤1:创建初始化脚本
在Databricks工作区的/databricks/init/目录下创建Shell脚本(例:install-mssql-connector.sh),内容如下:
#!/bin/bash # 向Spark配置文件追加Maven库参数 cat >> /databricks/driver/conf/spark.conf << 'EOF' spark.jars.packages com.microsoft.azure:spark-mssql-connector_2.12:1.1.0 EOF
脚本说明:集群启动时自动将指定Maven库配置写入驱动节点的Spark配置文件,Spark会自动完成库的下载与加载。
步骤2:配置全局生效
- 登录Databricks控制台,进入集群页面,点击顶部的全局初始化脚本
- 点击添加,选择刚创建的脚本文件
- 确认脚本启用状态为「开启」,保存设置
验证
启动任意新集群,直接在Spark作业中使用com.microsoft.azure.sqlserver.jdbc.spark相关类即可,无需手动额外安装。
内容的提问来源于stack exchange,提问作者Rob G.
相关产品推荐
相关产品推荐

