如何在GCP上运行带GPU及私有仓库的COS虚拟机
GCP COS GPU虚拟机+Artifact Registry镜像配置指南
1. GPU驱动安装操作
COS系统自带GPU驱动自动加载机制,无需手动编译安装。创建VM时选择带GPU的机器类型(比如n1-standard-8搭配T4),启动后系统会自动初始化GPU模块。
验证驱动是否生效,登录VM后执行:nvidia-smi
如果无输出,重启VM即可,COS会在启动流程中完成驱动加载。
2. Cloud Config配置方法
Cloud Config是COS的初始化配置文件,采用YAML格式,创建VM时通过自定义元数据的user-data字段传入。以下是配置Docker开机启动的示例:
#cloud-config runcmd: - systemctl start docker - systemctl enable docker write_files: - path: /etc/docker/daemon.json content: | { "log-driver": "json-file", "log-opts": { "max-size": "10m" } }
注意:YAML对缩进要求严格,runcmd内的命令会按顺序执行,可根据需求添加自定义操作。
3. 无需手动登录拉取私有Artifact Registry镜像
给COS虚拟机绑定具备Artifact Registry Reader角色的服务账号,就能自动获取凭证拉取私有镜像,无需手动执行docker login:
- 创建VM时指定带有
roles/artifactregistry.reader权限的服务账号 - 直接用完整镜像地址拉取:
docker pull us-central1-docker.pkg.dev/[项目ID]/[仓库名]/[镜像名]:[标签]
COS会自动通过元数据服务器获取临时凭证,完成私有镜像拉取。
4. 拉取后Docker容器运行方法
拉取完成后,启动容器时需加上GPU挂载参数,确保容器能调用GPU资源:docker run --gpus all -d -p 8080:8080 us-central1-docker.pkg.dev/[项目ID]/[仓库名]/[镜像名]:[标签]
如果需要持久化数据,添加-v参数挂载主机目录:docker run --gpus all -d -v /host/local/data:/container/path/data -p 8080:8080 [完整镜像地址]
内容的提问来源于stack exchange,提问作者njho
相关产品推荐
相关产品推荐

