You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何让Google Batch使用带GPU的预留实例以规避配额限制?

解决Google Batch调用GPU预留实例的问题

问题根源

你的Batch作业配置中未显式指定预留亲和性类型为"SPECIFIC",导致调度系统没有强制绑定到你创建的专属预留实例,仍尝试使用区域共享GPU配额,从而触发NVIDIA_T4_GPUS配额限制。而直接创建VM时你通过--reservation-affinity=specific明确指定了亲和性类型,所以能正常使用预留。

修正后的Batch配置

修改test.json中的allocationPolicy部分,添加reservationAffinity字段并指定类型为SPECIFIC,同时关联你的预留实例:

{
  .....
  "allocationPolicy": {
    "instances": [
      {
        "policy": {
          "machineType": "n1-highcpu-8",
          "accelerators": [
            {
              "type": "nvidia-tesla-t4",
              "count": 1
            }
          ],
          "reservationAffinity": {
            "type": "SPECIFIC",
            "reservations": [
              {
                "reservation": "projects/my-project-name/reservations/reservation-for-google-batch"
              }
            ]
          }
        }
      }
    ],
    "location": {
      "allowedLocations": [
        "zones/us-central1-f"
      ]
    }
  },
  .....
}

关键验证点

  • 确保预留实例的所有属性与Batch作业配置完全匹配:机器类型n1-highcpu-8、GPU型号/数量nvidia-tesla-t4(count=1)、可用区us-central1-f
  • 由于你创建预留时使用了--require-specific-reservation,必须通过显式的SPECIFIC亲和性才能调用该预留

测试步骤

  1. 用修正后的配置重新提交作业:
    gcloud batch jobs submit test-reservation-gpu --location us-central1 --config test.json
    
  2. 查看作业事件日志,确认调度时已绑定到预留实例,不再出现配额不足的提示。

内容的提问来源于stack exchange,提问作者MrGod

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.27 18:20:21