TensorFlow1.13.1+CUDA10.0在RTX3070上运行出现Blas GEMM launch failed错误
报错核心原因
RTX 3070属于英伟达安培架构显卡,最低仅支持CUDA 11.0及以上版本,你当前安装的CUDA 10.0完全无法适配30系显卡,是触发cuBLAS调用失败、GEMM运算无法启动的根本原因。同时你使用的tensorflow 1.13.1版本原生最高仅支持CUDA 10.2,本身也不兼容更高版本的CUDA,进一步加剧了版本冲突。
解决方案
- 先完全卸载现有环境中的CUDA、cuDNN、tensorflow、tensorflow-gpu相关组件,清除所有版本残留,避免后续冲突
- 根据你的开发需求选择适配30系显卡的依赖组合:
- 可接受升级到tensorflow 2.x的情况:安装 CUDA 11.0 + cuDNN 8.0 + tensorflow-gpu==2.4.0,该组合兼容性经过大量验证,可稳定在30系显卡上运行
- 必须使用tensorflow 1.x的情况:不能使用原生的1.13.1版本,需安装英伟达定制适配的
tensorflow-gpu==1.15.5版本,配合CUDA 11.2 + cuDNN 8.1使用,这是唯一可在30系显卡上正常运行的tensorflow 1.x分支版本
- 依赖替换完成后如果仍出现同类报错,可以先调小训练的batch size,排除显存不足触发的同类型运算失败问题
内容的提问来源于stack exchange,提问作者Clara Ho
相关产品推荐
相关产品推荐

