Windows Conda环境下TensorFlow GPU部署故障求助
本地Conda环境下TensorFlow使用RTX3070Ti GPU训练异常问题
我在Python-Conda环境中尝试用PC的Nvidia RTX 3070Ti GPU运行TensorFlow,解决Kaggle小型图像分类问题。该问题已在Google Colab上顺利解决,但本地运行TensorFlow时出现异常,查阅大量方案仍未解决。
我遵循官方指南安装对应版本的TF与CUDA:cuda-toolkit 10.1、cudnn 7.6、tf-gpu 2.3、Python 3.8,且已安装最新Nvidia显卡驱动。
已尝试的操作:
- 从Nvidia官网安装对应版本的CUDA-toolkit与CUDnn,配置好PATH,MS Visual Studio可正常识别,但conda环境中安装的TensorFlow-GPU无法识别GPU,仅使用CPU。
- 卸载所有CUDA与CUDnn,通过conda环境安装CUDA-toolkit、CUDnn及TensorFlow-GPU,此时TF可识别并使用GPU,但DNN训练时出现错误:
Failed to launch ptxas Relying on driver to perform ptx compilation. Modify $PATH to customize ptxas location.,且训练精度极低无提升,而相同代码与数据在Google Colab上第5轮epoch即可达到约90%的精度。 - 尝试tf 2.1及对应版本的cuda与cudnn,问题依旧。
- 安装cudatoolkit-dev,仍未解决ptxas错误。
我几乎要放弃TensorFlow转而使用PyTorch,恳请帮助。
内容的提问来源于stack exchange,提问作者Roman Velichkin
相关产品推荐
相关产品推荐

