You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何通过Google Dataproc客户端为Spark作业传递自定义Job ID?

解决Google Dataproc Spark作业自定义Job ID问题

要给Dataproc Spark作业指定自定义Job ID,你需要在提交的job字典中添加reference字段,明确指定job_id参数。修改后的代码如下:

job = {
    "reference": {
        "job_id": "your-custom-job-id"  # 替换为你想要的自定义Job ID
    },
    "placement": {"cluster_name": cluster_name},
    "spark_job": {
        "main_class": "org.example.App",
        "jar_file_uris": [
          "gs://location.jar",
        ],
        "args": [],
    },
}

operation = job_client.submit_job_as_operation(
     request={"project_id": project_id, "region": region, "job": job}
)

注意事项

  • 自定义Job ID需在当前项目和区域内唯一,不能与已存在的作业ID重复
  • Job ID仅允许包含小写字母、数字、连字符(-)和下划线(_),长度上限为100字符
  • 若指定的ID已存在,API会返回错误,建议加入时间戳或唯一标识确保ID唯一性,比如my-spark-job-20240520-1430

内容的提问来源于stack exchange,提问作者Faisal Khan

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.05 11:15:35