You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Microsoft Azure部署gpt4o-mini并获取Custom LLM URL

在Azure OpenAI中部署GPT-4o-mini并获取端点URL的步骤

你遗漏的核心步骤是创建模型部署实例——仅创建Azure OpenAI资源还不够,需要为gpt-4o-mini单独部署一个可对外调用的实例,具体操作如下:

  1. 创建GPT-4o-mini部署

    • 登录Azure门户,找到你已创建的OpenAI资源,在左侧菜单选择「模型部署」
    • 点击「创建部署」,在模型列表中选择gpt-4o-mini,设置一个自定义的部署名称(后续会用到),按需调整令牌限制等参数后完成创建
  2. 获取基础端点与密钥

    • 部署完成后,回到OpenAI资源的「概述」页面,复制页面上显示的端点(格式为https://<你的资源名称>.openai.azure.com/)
    • 在左侧菜单「密钥和终结点」中,复制任意一个密钥(调用API时需要身份验证)
  3. 构造完整的自定义LLM调用URL
    完整的可直接用于AI应用的端点格式为:

    https://<你的资源名称>.openai.azure.com/openai/deployments/<你的部署名称>/chat/completions?api-version=2024-02-15-preview
    

    替换其中的<你的资源名称>和<你的部署名称>为实际值,api-version可选用Azure官方提供的最新稳定版本

  4. 验证端点可用性
    可以用curl命令快速测试:

    curl https://<你的资源名称>.openai.azure.com/openai/deployments/<你的部署名称>/chat/completions?api-version=2024-02-15-preview \
      -H "Content-Type: application/json" \
      -H "api-key: <你的密钥>" \
      -d '{"messages": [{"role": "user", "content": "Hello"}]}'
    

    能返回包含聊天响应的JSON数据,即说明端点可正常对外使用

内容的提问来源于stack exchange,提问作者LLM-Variety

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.14 20:45:55