You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Databricks 9.1集群无法访问/Workspace问题求助

解决9.1版本多节点集群访问/Workspace时的"Resource temporarily unavailable"错误

以下是针对9.1版本集群的排查和修复步骤,无需升级即可尝试:

  • 检查目录挂载与远程服务状态
    先确认/Workspace的挂载类型,执行:

    mount | grep /Workspace
    

    如果是NFS挂载,检查NFS服务端的连接状态:

    rpcinfo -p <NFS服务器IP>
    

    查看服务端日志是否存在连接耗尽或资源拒绝的记录,9.1版本对NFS连接的并发处理不如13.3版本稳定,可临时重启NFS服务端释放连接。

  • 修正目录权限与ACL配置
    13.3版本可能放宽了权限检查逻辑,9.1版本严格要求目录的执行权限。先查看当前权限:

    ls -ld /Workspace
    # 若是HDFS目录则执行:
    hdfs dfs -ls /Workspace
    

    确保当前用户拥有目录的执行(x)权限,若缺失则添加:

    chmod +x /Workspace
    # HDFS目录执行:
    hdfs dfs -chmod +x /Workspace
    

    同时检查ACL规则,添加必要的用户访问权限:

    getfacl /Workspace
    setfacl -m u:你的用户名:rx /Workspace
    
  • 调整集群资源与调度配置
    9.1版本的资源调度器可能限制了目录访问的并发资源配额。检查YARN相关配置,比如调整yarn.nodemanager.resource.memory-mb或yarn.scheduler.maximum-allocation-mb参数,确保节点有足够内存处理目录请求。同时检查磁盘IO负载:

    iostat -x 1 5
    

    若磁盘IO使用率过高,临时停止非核心任务释放资源,再尝试访问目录。

  • 修复分布式文件系统元数据问题
    如果/Workspace是分布式文件系统(如HDFS)的目录,9.1版本的元数据节点可能存在锁冲突或元数据损坏。执行文件系统检查:

    hdfs fsck /Workspace -files -blocks -locations
    

    若发现损坏块,执行清理命令后重启元数据服务:

    hdfs fsck /Workspace -delete
    

内容的提问来源于stack exchange,提问作者Bryan K.

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.04 13:43:18