操作中无法选中Job Manager的问题原因及排查咨询
无法选中Job Manager问题排查修复方案
问题表现
操作集群控制台过程中,Job Manager选项无法正常选中,对应错误界面如下:
排查&解决方法
按优先级从高到低依次排查即可:
- 前端缓存异常
浏览器本地缓存的旧版控制台静态资源会导致前端交互逻辑失效,是这类问题最高发的诱因。直接按Ctrl+F5(Mac端按Cmd+Shift+R)强制刷新页面,或清理对应站点的浏览器缓存后重新登录,多数场景下可直接恢复。 - 账号权限缺失
若刷新后选项仍处于置灰不可选状态,优先核对当前登录账号的权限配置:未绑定Job Manager页面查看、运维权限的账号,会被前端直接限制操作入口。联系集群管理员补全对应角色权限后重新登录即可。 - Job Manager服务端异常
若选项可点击但无响应、或加载后报错,说明后端Job Manager进程处于异常状态:- 物理机/虚拟机部署场景:登录集群主节点执行
ps -ef | grep JobManager确认进程存活,查看$FLINK_HOME/log/目录下的jobmanager日志,排查是否存在OOM、元数据存储(ZooKeeper/MySQL)连接超时类报错,异常进程直接执行$FLINK_HOME/bin/jobmanager.sh start重启即可 - Kubernetes部署场景:执行
kubectl get pods -n <集群所在命名空间> | grep jobmanager查看Pod运行状态,对处于CrashLoopBackOff、Error状态的Pod执行kubectl delete pod <异常Pod名称>触发自动重建,再查看Pod事件和日志定位根因。
- 物理机/虚拟机部署场景:登录集群主节点执行
注意:如果是刚完成集群版本升级后出现该问题,90%以上为前端缓存导致,强制刷新即可解决,无需调整后端配置。
内容的提问来源于stack exchange,提问作者Forneus07
相关产品推荐
相关产品推荐

