GCP单区域多Spot/抢占式GPU配额申请被拒,如何解决?
GCP抢占式GPU配额申请问题
我正在构建GPT2、BERT等自然语言处理(NLP)深度学习模型。我的GPUS_ALL_REGIONS配额申请已部分获批(4个GPU),希望在单个实例中使用最多4个GPU,但所有单区域申请超过2个PREEMPTIBLE_NVIDIA_A100/V100_GPUS(即Spot/抢占式GPU)的请求均被拒绝。
已执行操作
- 确认账单账户及信用卡注册无误;
- 确认未以免费试用用户身份登录;
- 针对不同区域、不同GPU类型(A100、V100、T4、P100)多次提交配额申请;
- 确认通过
gcloud auth log-in登录的是对应账单账户。
期望结果
- 将每个单区域的GPU配额从1提升至4;
- 将
GPUS_ALL_REGIONS配额提升至区域数量的4倍; - 成功执行以下gcloud-cli命令(其中
ACCELERATOR="count=${NUM_GPUS},type=nvidia-tesla-a100"):
gcloud compute instances create ${VM_NAME} --preemptible \ --zone ${ZONE} \ --machine-type ${MACHINE_TYPE} \ --network-interface=${NETWORK_INTERFACE} \ --maintenance-policy=TERMINATE \ --provisioning-model=SPOT \ --service-account="**********@developer.gserviceaccount.com" \ --accelerator=${ACCELERATOR} \ --enable-display-device --tags=http-server,https-server \ --create-disk=auto-delete=yes,boot=yes,device-name=instance-1,image=projects/debian-cloud/global/images/debian-11-bullseye-v20221206,mode=rw,size=${BOOT_DISK_SIZE},type=projects/${PROJECT_NAME}/zones/${ZONE}/diskTypes/${BOOT_DISK_TYPE} \ --image-project ${IMAGE_PROJECT} \ --image-family ${IMAGE_FAMILY} \ --no-shielded-secure-boot --shielded-vtpm --shielded-integrity-monitoring --reservation-affinity=any \ --threads-per-core=2 --visible-core-count=6
内容的提问来源于stack exchange,提问作者atsu3110
相关产品推荐
相关产品推荐

