You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Windows 10下在VS Code中为Python(llama-cpp-python)启用GPU的方法

Windows 10下为llama-cpp-python启用Nvidia GPU推理的步骤

我在配备32GB内存、4GB显存Nvidia P100 GPU的Windows 10设备上开发Python程序时,发现大语言模型(LLMs)推理过程未调用本机GPU,耗费大量精力后总结出以下可行步骤:

  • 安装C分发组件:打开Visual Studio 2022安装程序,勾选「使用C的桌面开发」分类下的「Windows 10 SDK (10.0.20348.0)」选项(对应勾选选项的截图示例:Visual Studio安装界面中展示该勾选项),完成安装。
  • 下载并安装Nvidia CUDA Toolkit
  • 确保系统环境变量中已配置CUDA_PATH
  • 在Visual Studio Code中设置以下环境变量:
$env:CMAKE_ARGS="-DLLAMA_CUBLAS=on"
$env:CUDACXX="C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v12.2\bin\nvcc.exe"
  • 执行以下命令重装升级llama-cpp-python:
pip install llama-cpp-python --no-cache-dir --force-reinstall --upgrade

完成上述操作后,运行Python程序时会看到BLAS已设置为1的提示(对应运行提示的截图示例)。

内容的提问来源于stack exchange,提问作者Umaima Tinwala

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.02 04:42:44