GCP环境下Databricks工作区无法创建集群,提示无可用GKE集群
GCP Databricks集群创建失败报错解决方案
报错原文:
No active Google Kubernetes Engine cluster found for workspace. Retrying Google Kubernetes Engine cluster creation
该报错为Databricks工作区无法完成底层依赖GKE集群的自动调配导致,和你已启用的基础API无直接关联,可按以下步骤逐一排查解决:
校验Databricks服务账号权限
首先确认GCP项目内Databricks专属服务账号
service-<你的工作区数字ID>@gcp-databricks.iam.gserviceaccount.com已被授予以下必要角色:roles/container.adminroles/compute.adminroles/iam.serviceAccountUser
权限缺失的情况下,直接在GCP IAM控制台为该账号补充对应角色即可。
检查VPC网络配置
若你使用自定义VPC部署Databricks而非系统默认生成的网络,需要确认以下配置:
- VPC对应子网已开启专用Google访问,保障GKE节点可通过内网访问GCP各类服务
- 子网已提前配置Secondary IP范围,预留足够IP段供GKE的Pod和Service资源使用
- 防火墙规则未屏蔽Databricks控制平面和GKE集群之间的内部通信端口
确认GCP区域资源配额充足
前往GCP配额控制台,检查当前Databricks部署区域的以下资源配额没有达到上限:
- GKE集群数量配额
- Compute Engine CPU、内存配额
- 区域静态IP地址配额
配额不足可提交配额提升申请,审批通过后再重试操作。
手动重调工作区底层基础架构
以上配置全部确认无误后,可进入Databricks工作区管理控制台的云资源管理页,点击重新调配基础架构,等待10到15分钟基础资源部署完成后,再尝试创建Databricks计算集群。
内容的提问来源于stack exchange,提问作者Pritish
相关产品推荐
相关产品推荐

