解决:could not load library libcudnn_cnn_train.so.8

训练模型时报下面错误:

could not load library libcudnn_cnn_train.so.8

出现错误的可能原因:

PyTorch 有自己的 CUDA 依赖项(包括 cuDNN),所以需要从库路径中移除本地安装的 cuDNN,让 PyTorch 加载它自己的库。

如果想使用本地安装的 CUDA 工具包,可以从源代码构建 PyTorch。

解决方法之一:

python 复制代码
cd /usr/local/cuda-12.1/lib64
sudo rm -f libcudnn*
cd /usr/local/cuda-12.1/include
sudo rm -f cudnn*

参考文档:

https://discuss.pytorch.org/t/could-not-load-library-libcudnn-cnn-train-so-8-but-im-sure-that-i-have-set-the-right-ld-library-path/190277/2

相关推荐
网络工程小王1 小时前
【HCIE-AI】12.deepspeed分布式并行训练进阶版
人工智能·pytorch·分布式·学习·昇腾·deepspeed
qizayaoshuap5 小时前
# 秒表 — HarmonyOS 高精度计时与圈速记录实战
人工智能·pytorch·深度学习·华为·harmonyos
海海不掉头发1 天前
【PyTorch 实战】基于 RNN/LSTM/GRU 的全球人名国籍分类器(通俗拆解 + 逐行详解)】
pytorch·rnn·lstm
学术小李2 天前
基于Pytorch,如何用CUDA自己写算子?(一)
人工智能·pytorch·python
a1117762 天前
基于PyTorch的动物图像识别系统 开源
人工智能·pytorch·python
FriendshipT2 天前
Ultralytics:解读Proto模块
人工智能·pytorch·python·深度学习·目标检测
向哆哆3 天前
【Bug已解决】DAPO loss is not normalized by gradient_accumulation_steps 解决方案
pytorch·深度学习·分布式训练·bug解决方案
程序员羽痕3 天前
基于 Django + PyTorch 的中文字体识别系统
pytorch·python·django
培之4 天前
RTX 5090 安装 pytorch3d
人工智能·pytorch·python