NVIDIA-SMI has failed because it couldn“t communicate with the NVIDIA driver .

文章目录

报错

  1. 执行nvidia-smi报错

    NVIDIA-SMI has failed because it couldn"t communicate with the NVIDIA driver .
    Make sure that the atest NVIDIA driver is installed and running.

  2. 运行使用gpu的docker容器时

    NVIDIA Docker - initialization error: nvml error: driver not loaded

原因分析

  1. 大概率是因为重启后内核升级了 (起码我的问题是因为这样)。
  2. 驱动文件被删除

解决办法

  1. 查看显卡连接是否正常
sh 复制代码
$ sudo lshw -C display

应该会输出

  1. 查看已安装内核
sh 复制代码
$ dpkg --get-selections |grep linux-image
  1. 查看在使用内核
sh 复制代码
$ uname -a

如果本地有多核内核大概可能是因为内核升级导致驱动无法识别

  1. 查看本地之前安装的驱动版本
sh 复制代码
$ ls /usr/src | grep nvidia

输出:nvidia-515.105.01 (记住:515.105.01 这个版本号)

5... 此时只需要执行

复制代码
$ sudo apt-get install dkms
$ sudo dkms install -m nvidia -v 515.105.01(515.105.01表示的是驱动版本号,上面查到的)
  1. 此时应该是解决了此问题
sh 复制代码
$ nvidia-smi

可以看到gpu的列表

防患于未然

1)命令行关闭系统自动更新,使用命令打开文件并编辑

sh 复制代码
$ sudo gedit /etc/apt/apt.conf.d/10periodic

将双引号中的"1"全部置"0"即可,修改后保存。

相关推荐
Star abuse2 分钟前
Python爬虫课程实验指导书
开发语言·爬虫·python
秋名RG10 分钟前
简单了解Java的I/O流机制与文件读写操作
java·开发语言·python
闲人编程21 分钟前
OpenCV图像轮廓分析完全指南
python·opencv·图像识别
神仙别闹29 分钟前
基于Python+Neo4j实现新冠信息挖掘系统
开发语言·python·neo4j
navyDagger30 分钟前
GAN生成对抗网络数学原理解释并实现MNIST数据集生产(附代码演示)
人工智能·python
没有梦想的咸鱼185-1037-166334 分钟前
【降尺度】ChatGPT+DeepSeek+python+CMIP6数据分析与可视化、降尺度技术与气候变化的区域影响、极端气候分析
python·chatgpt·数据分析
berryyan37 分钟前
傻瓜教程安装Trae IDE用AI撰写第一个AKShare接口脚本
python·trae
灏瀚星空1 小时前
从基础到实战的量化交易全流程学习:1.3 数学与统计学基础——概率与统计基础 | 基础概念
笔记·python·学习·金融·概率论
Hellohistory1 小时前
HOTP 算法与实现解析
后端·python
伊织code1 小时前
cached-property - 类属性缓存装饰器
python·缓存·cache·装饰器·ttl·property·cached-property