Nvidia驱动莫名其妙不好使了?nvidia-smi报错?如何解决?已解决!!

2024-08-27 05:04

本文主要是介绍Nvidia驱动莫名其妙不好使了?nvidia-smi报错?如何解决?已解决!!,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

在这里插入图片描述

文章目录

  • 一、报错提示
  • 二、解决方案
    • 2.1 原因1的解决办法
    • 2.2 原因2的解决方案

一、报错提示

  1. Ubuntu20.04出现Failed to initialize NVML: Driver/library version mismatch问题
  2. NVIDIA-SMI has failed because it couldn‘t communicate with the NVIDIA driver.

二、解决方案

如果是这两种报错,则可能是两个原因:
原因1:系统自动升级导致内核版本和Nvidia驱动版本不匹配;
原因2:操作系统的BIOS的设置问题;

2.1 原因1的解决办法

  1. 首先查看下Nvidia驱动的版本和内核的版本
ls /usr/src | grep nvidia
uname -a
  1. 然后卸载nvidia驱动程序
sudo apt-get purge nvidia*
  1. 查询自带的驱动
ubuntu-drivers devices
  1. 选择recommend标志的驱动程序安装
sudo apt install XXXXXX
  1. 安装完毕后验证一下,观察是否会报错
sudo modprobe nvidia
  1. 最后看是否正常
nvidia-smi

参考链接:

  1. https://blog.csdn.net/ccsodefhy/article/details/122846921
  2. https://blog.csdn.net/weixin_43994864/article/details/116143207
  3. https://blog.51cto.com/u_4029519/5909904
  4. https://www.volcengine.com/theme/2267486-J-7-1
  5. Ubuntu:解决显卡驱动问题NVIDIA-SMI has failed because it couldn‘t communicate with the NVIDIA driver._ubuntu
  6. Nvidia-smi gives “No devies were found” - incorrect gcc version

2.2 原因2的解决方案

方法1. 禁用 Secure Boot

  • 进入 BIOS 设置,找到 Secure Boot 选项,并将其禁用。
  • 保存更改并退出 BIOS,然后重新启动系统。
  • 之后再尝试加载 NVIDIA 模块:
    sudo modprobe nvidia

方法2. 手动签名内核模块(如果你需要启用 Secure Boot):

如果你不想禁用 Secure Boot,可以手动签名 NVIDIA 模块。以下是大致步骤:

  1. 安装 mokutil工具:
sudo apt-get install mokutil
  1. 生成自签名证书:
openssl req -new -x509 -newkey rsa:2048 -keyout MOK.priv -outform DER -out MOK.der -nodes -days 36500 -subj "/CN=My NVIDIA Module Signing Key"
  1. 注册 MOK(Machine Owner Key):
sudo mokutil --import MOK.der

你将被要求设置一个密码,这将在下一次启动时使用。

  1. 重启系统并进入 MOK 管理界面:
  • 系统重启时,系统会提示你进入 MOK 管理界面,在那里你可以选择“Enroll MOK”并输入刚才设置的密码。
  1. 签名 NVIDIA 模块:
sudo /usr/src/linux-headers-$(uname -r)/scripts/sign-file sha256 ./MOK.priv ./MOK.der $(modinfo -n nvidia)
  1. 再次加载 NVIDIA 模块:
sudo modprobe nvidia

注意事项:

  • 签名工具和步骤:确保你使用了系统当前内核版本的 sign-file 工具,路径可能会因内核版本而不同。
  • 恢复操作:如果出现问题,你可以随时禁用 Secure Boot 或删除 MOK 来回到原始状态。

∼ O n e p e r s o n g o f a s t e r , a g r o u p o f p e o p l e c a n g o f u r t h e r ∼ \sim_{One\ person\ go\ faster,\ a\ group\ of\ people\ can\ go\ further}\sim One person go faster, a group of people can go further

这篇关于Nvidia驱动莫名其妙不好使了?nvidia-smi报错?如何解决?已解决!!的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1110706

相关文章

Springboot项目启动失败提示找不到dao类的解决

《Springboot项目启动失败提示找不到dao类的解决》SpringBoot启动失败,因ProductServiceImpl未正确注入ProductDao,原因:Dao未注册为Bean,解决:在启... 目录错误描述原因解决方法总结***************************APPLICA编

解决pandas无法读取csv文件数据的问题

《解决pandas无法读取csv文件数据的问题》本文讲述作者用Pandas读取CSV文件时因参数设置不当导致数据错位,通过调整delimiter和on_bad_lines参数最终解决问题,并强调正确参... 目录一、前言二、问题复现1. 问题2. 通过 on_bad_lines=‘warn’ 跳过异常数据3

解决RocketMQ的幂等性问题

《解决RocketMQ的幂等性问题》重复消费因调用链路长、消息发送超时或消费者故障导致,通过生产者消息查询、Redis缓存及消费者唯一主键可以确保幂等性,避免重复处理,本文主要介绍了解决RocketM... 目录造成重复消费的原因解决方法生产者端消费者端代码实现造成重复消费的原因当系统的调用链路比较长的时

深度解析Nginx日志分析与499状态码问题解决

《深度解析Nginx日志分析与499状态码问题解决》在Web服务器运维和性能优化过程中,Nginx日志是排查问题的重要依据,本文将围绕Nginx日志分析、499状态码的成因、排查方法及解决方案展开讨论... 目录前言1. Nginx日志基础1.1 Nginx日志存放位置1.2 Nginx日志格式2. 499

SpringBoot监控API请求耗时的6中解决解决方案

《SpringBoot监控API请求耗时的6中解决解决方案》本文介绍SpringBoot中记录API请求耗时的6种方案,包括手动埋点、AOP切面、拦截器、Filter、事件监听、Micrometer+... 目录1. 简介2.实战案例2.1 手动记录2.2 自定义AOP记录2.3 拦截器技术2.4 使用Fi

kkFileView启动报错:报错2003端口占用的问题及解决

《kkFileView启动报错:报错2003端口占用的问题及解决》kkFileView启动报错因office组件2003端口未关闭,解决:查杀占用端口的进程,终止Java进程,使用shutdown.s... 目录原因解决总结kkFileViewjavascript启动报错启动office组件失败,请检查of

SQL Server安装时候没有中文选项的解决方法

《SQLServer安装时候没有中文选项的解决方法》用户安装SQLServer时界面全英文,无中文选项,通过修改安装设置中的国家或地区为中文中国,重启安装程序后界面恢复中文,解决了问题,对SQLSe... 你是不是在安装SQL Server时候发现安装界面和别人不同,并且无论如何都没有中文选项?这个问题也

java内存泄漏排查过程及解决

《java内存泄漏排查过程及解决》公司某服务内存持续增长,疑似内存泄漏,未触发OOM,排查方法包括检查JVM配置、分析GC执行状态、导出堆内存快照并用IDEAProfiler工具定位大对象及代码... 目录内存泄漏内存问题排查1.查看JVM内存配置2.分析gc是否正常执行3.导出 dump 各种工具分析4.

Linux之platform平台设备驱动详解

《Linux之platform平台设备驱动详解》Linux设备驱动模型中,Platform总线作为虚拟总线统一管理无物理总线依赖的嵌入式设备,通过platform_driver和platform_de... 目录platform驱动注册platform设备注册设备树Platform驱动和设备的关系总结在 l

Spring的RedisTemplate的json反序列泛型丢失问题解决

《Spring的RedisTemplate的json反序列泛型丢失问题解决》本文主要介绍了SpringRedisTemplate中使用JSON序列化时泛型信息丢失的问题及其提出三种解决方案,可以根据性... 目录背景解决方案方案一方案二方案三总结背景在使用RedisTemplate操作redis时我们针对