虚拟机内部执行nvidia-smi报错(linux)

举报
呼哈呼哈 发表于 2021/01/19 16:27:19 2021/01/19
2w+ 0 0
【摘要】 现象一虚拟机内部执行nvidia-smi报错:“NVIDIA-SMI has failed because it couldn't communicate with the NVIDIA driver. Make sure that the latest NVIDIA driver is installed and running.”一般是因为系统内核升级了,需要重新安装NVIDIA驱动 现...

现象一

虚拟机内部执行nvidia-smi报错:“NVIDIA-SMI has failed because it couldn't communicate with the NVIDIA driver. Make sure that the latest NVIDIA driver is installed and running.


一般是因为系统内核升级了,需要重新安装NVIDIA驱动

 

现象二

执行nvidia-smi,单卡机器显示“No devices were found或者 多卡机器上显示卡数目不全

如:


首先排查设备是否存在:lspci | grep –i nvidia

设备存在,执行nvidia-smi后查看虚拟机messages日志,有如下报错:

解决方法:重启虚拟机,重启之后执行nvidia-smi -pm 1(每次重启后都要执行一次)

【声明】本内容来自华为云开发者社区博主,不代表华为云及华为云开发者社区的观点和立场。转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息,否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

作者其他文章

评论(0

抱歉,系统识别当前为高风险访问,暂不支持该操作

    全部回复

    上滑加载中

    设置昵称

    在此一键设置昵称,即可参与社区互动!

    *长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

    *长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。