You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

GeForce GT730运行face_recognition的CUDA/cuDNN报错咨询

问题:GeForce GT 730(计算能力3.5)运行face_recognition的CUDA相关报错及后续问题

初始报错与环境配置

在Windows 10系统的GeForce GT 730 GPU(计算能力3.5)上运行face_recognition,环境配置为cudatoolkit 11.3、cuDNN 8.2.1、475.14驱动,执行以下代码时出现报错:

face_encodings = face_recognition.face_encodings(images, face_locations)

报错信息:

Error while calling cudaOccupancyMaxPotentialBlockSize(&num_blocks,&num_threads,K) in file c:\users\zachb\anaconda3\envs\dlib5\dlib\dlib\cuda\cuda_utils.h:186. code: 98, reason: invalid device function

最初尝试从NVIDIA归档文件安装CUDA toolkit和cuDNN,并将cuDNN文件夹复制到toolkit目录,但导入dlib时始终出现ImportError: DLL load failed: The specified module could not be found.错误。后续通过conda安装cudatoolkit和cudnn解决了该问题,于是卸载系统级CUDA,通过nvidia conda通道在Python环境中安装,具体流程如下:

cd C:\Users\zachb\anaconda3\envs

conda create --name dlib python=3.8 cmake ipython

cd C:\Users\zachb\anaconda3\envs\dlib

conda install conda-forge::cudnn=8.2.1 conda-forge::cudatoolkit=11.3 cuda -c nvidia/label/cuda-11.3.0 -c nvidia/label/cuda-11.3.1

git clone https://github.com/davisking/dlib.git

cd dlib

mkdir build

cd build

cmake .. -G "Visual Studio 15 2017" -A x64 -DDLIB_USE_CUDA=1 -DDLIB_USE_CUDA_COMPUTE_CAPABILITIES="35" -DUSE_AVX_INSTRUCTIONS=1 -DCUDAToolkit_ROOT="C:\Users\zachb\anaconda3\envs\dlib\bin"

cmake --build .

cd ..

python setup.py install --set DLIB_USE_CUDA=1

conda install numpy matplotlib Pillow

conda install click=8.1.7 colorama=0.4.6 face-recognition=1.3.0 face_recognition_models=0.3.0 --no-dep

执行print(dlib.DLIB_USE_CUDA)返回true,期间还尝试过conda安装CUDA后复制cuDNN到环境目录(仍出现导入dlib错误),也试过CUDA 11.2、11.3、11.4、11.5、11.8及对应cuDNN版本,但均未解决初始报错。

部分问题解决与新报错

通过以下操作解决了部分问题:cmake构建后修改setup.py文件,同时在系统中安装了CUDA 10.2和cuDNN 7.6.5。setup.py修改内容为在cmake_args中添加相关参数:

cmake_args = ['-DCMAKE_LIBRARY_OUTPUT_DIRECTORY=' + extdir,
                      '-DPYTHON_EXECUTABLE=' + sys.executable,
                      '-DDLIB_USE_FFMPEG=OFF',
                      '-DDLIB_USE_CUDA=1',
                      '-DDLIB_USE_CUDA_COMPUTE_CAPABILITIES=35',
                      '-DUSE_AVX_INSTRUCTIONS=1']

但现在执行face_recognition.face_locations(img, model="cnn")时出现新错误:

RuntimeError: Error while calling cudnnConvolutionBiasActivationForward( context(), &alpha1, descriptor(data), data.device(), (const cudnnFilterDescriptor_t)filter_handle, filters.device(), (const cudnnConvolutionDescriptor_t)conv_handle, (cudnnConvolutionFwdAlgo_t)forward_algo, forward_workspace, forward_workspace_size_in_bytes, &alpha2, out_desc, out, descriptor(biases), biases.device(), use_relu ? relu_activation_descriptor() : identity_activation_descriptor(), out_desc, out) in file C:\Users\zachb\anaconda3\envs\dlib\dlib\dlib\cuda\cudnn_dlibapi.cpp:1253. code: 9, reason: CUDNN_STATUS_NOT_SUPPORTED

已了解到该错误可能由cuDNN版本导致,目前可以执行部分获取编码和位置的dlib命令,但上述新问题仍未解决。


内容的提问来源于stack exchange,提问作者Zachary Baty

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.18 23:22:33