You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在docker-compose中使用NVIDIA GPU运行Ollama?求配置示例

可用的Ollama + NVIDIA GPU Docker Compose配置示例

你当前使用的ollama/ollama:rocm是针对AMD ROCm架构GPU的镜像,无法适配NVIDIA GPU。以下是适配NVIDIA GPU的完整docker-compose.yml配置:

version: '3.8'

services:
  ollama:
    container_name: ollama
    image: ollama/ollama:latest
    ports:
      - 11434:11434
    volumes:
      - ollama:/root/.ollama
    networks:
      - fastgpt
    restart: always
    # 配置GPU资源预留,适配NVIDIA GPU
    deploy:
      resources:
        reservations:
          devices:
            - driver: nvidia
              count: all  # 可改为具体GPU数量,如1
              capabilities: [gpu]
    # 若你的Docker版本不支持deploy语法,可替换为以下runtime配置(需提前配置NVIDIA容器运行时)
    # runtime: nvidia

volumes:
  ollama:

networks:
  fastgpt:
    # 若fastgpt网络已提前创建,保留该行;否则删除让Compose自动创建
    external: true

关键说明

  • 必须提前安装NVIDIA显卡驱动和NVIDIA Container Toolkit,否则容器无法识别GPU
  • 使用deploy语法需要Docker Compose版本2.10+;若版本较低,改用runtime: nvidia,同时需在/etc/docker/daemon.json中添加{"default-runtime": "nvidia"},然后重启Docker服务(systemctl restart docker)
  • 启动容器后,可通过docker exec -it ollama ollama run llama2拉取并测试模型,用ollama ps查看GPU占用状态

内容的提问来源于stack exchange,提问作者IronSpiderMan

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.25 06:47:15