NVIDIA-SMI has failed because it couldn“t communicate with the NVIDIA driver .

文章目录

报错

  1. 执行nvidia-smi报错

    NVIDIA-SMI has failed because it couldn"t communicate with the NVIDIA driver .
    Make sure that the atest NVIDIA driver is installed and running.

  2. 运行使用gpu的docker容器时

    NVIDIA Docker - initialization error: nvml error: driver not loaded

原因分析

  1. 大概率是因为重启后内核升级了 (起码我的问题是因为这样)。
  2. 驱动文件被删除

解决办法

  1. 查看显卡连接是否正常
sh 复制代码
$ sudo lshw -C display

应该会输出

  1. 查看已安装内核
sh 复制代码
$ dpkg --get-selections |grep linux-image
  1. 查看在使用内核
sh 复制代码
$ uname -a

如果本地有多核内核大概可能是因为内核升级导致驱动无法识别

  1. 查看本地之前安装的驱动版本
sh 复制代码
$ ls /usr/src | grep nvidia

输出:nvidia-515.105.01 (记住:515.105.01 这个版本号)

5... 此时只需要执行

复制代码
$ sudo apt-get install dkms
$ sudo dkms install -m nvidia -v 515.105.01(515.105.01表示的是驱动版本号,上面查到的)
  1. 此时应该是解决了此问题
sh 复制代码
$ nvidia-smi

可以看到gpu的列表

防患于未然

1)命令行关闭系统自动更新,使用命令打开文件并编辑

sh 复制代码
$ sudo gedit /etc/apt/apt.conf.d/10periodic

将双引号中的"1"全部置"0"即可,修改后保存。

相关推荐
杜子不疼.5 分钟前
《Python学习之文件操作:从入门到精通》
数据库·python·学习
微小的xx11 分钟前
java + html 图片点击文字验证码
java·python·html
金色旭光21 分钟前
uv 现代化的虚拟环境管理工具
python·python进阶
赞哥哥s42 分钟前
Python脚本开发-统计Rte中未连接的Port
python·autosar·rte
Franklin43 分钟前
Python界面设计【QT-creator基础编程 - 01】如何让不同分辨率图像自动匹配graphicsView的窗口大小
开发语言·python·qt
waynaqua1 小时前
FastAPI开发AI应用三:添加深度思考功能
python·openai·deepseek
onejason1 小时前
《利用 Python 爬虫获取 Amazon 商品详情实战指南》
前端·后端·python
苏婳6661 小时前
【最新版】怎么下载mysqlclient并成功安装?
数据库·python·mysql
0wioiw02 小时前
Python基础(Flask①)
后端·python·flask
飞翔的佩奇2 小时前
【完整源码+数据集+部署教程】食品分类与实例分割系统源码和数据集:改进yolo11-AggregatedAttention
python·yolo·计算机视觉·数据集·yolo11·食品分类与实例分割