非Root权限下无法运行带GPU的Docker容器问题求助
非Root用户运行带GPU参数的Docker容器报错问题
我从官方文档全新安装了Docker Desktop,随后按照官方文档安装了NVIDIA Container Toolkit。当我以非Root权限运行以下命令时:
docker run --rm --gpus all nvidia/cuda:11.6.2-base-ubuntu20.04 nvidia-smi
出现如下错误:
docker: Error response from daemon: failed to create shim task: OCI runtime create failed: runc create failed: unable to start container process: error during container init: error running hook #0: error running hook: exit status 1, stdout: , stderr: Auto-detected mode as 'legacy' nvidia-container-cli: initialization error: load library failed: libnvidia-ml.so.1: cannot open shared object file: no such file or directory: unknown.
使用sudo权限运行则无此错误,且运行不带--gpus all参数的非GPU容器也正常。
设备信息
- Ubuntu 22.04
- NVIDIA驱动:525,CUDA版本:12.0
- Docker Desktop:23.0.5
已尝试的解决方法
- 将用户添加至docker组和video组
- 安装nvidia-docker2
- 尝试修改ldconfig路径
- 修改GPU权限:
sudo chmod 666 /dev/nvidia* sudo chmod 666 /dev/nvidia-uvm*
- 设置
libnvidia-ml.so.1的权限:
sudo chown root:video /usr/local/nvidia/lib64/libnvidia-ml.so.1 sudo chmod 664 /usr/local/nvidia/lib64/libnvidia-ml.so.1
- 还有一些其他方法,后续想起会补充列出。
现在十分困惑,恳请各位提供解决建议,万分感谢!
内容的提问来源于stack exchange,提问作者neji96
相关产品推荐
相关产品推荐

