vgpu驱动NVIDIA-Linux-x86_64-595.91.04-vgpu-kvm.run下载和安装教程
📋 安装前的准备工作
在开始安装前,需要对服务器硬件和操作系统进行配置,否则安装过程可能失败,或vGPU无法正常工作。
-
硬件与BIOS设置:你的服务器需要配备NVIDIA官方支持vGPU技术的GPU(如Tesla、A系列等数据中心级显卡),并且CPU必须支持硬件虚拟化技术。在服务器BIOS中,确保开启以下关键选项:
- 虚拟化支持:Intel VT-x 或 AMD-V。
- SR-IOV:这是vGPU依赖的单根I/O虚拟化技术。
- Above 4G Decoding:为PCIe设备分配4G以上的内存地址空间。
- VT-d / IOMMU:对于部分GPU,这是硬件直通所必需的。
注意:对于使用AMD CPU的服务器,通常还需要额外开启ARI、ACS和AER选项。
-
操作系统准备:
- 开启IOMMU:在GRUB启动参数中添加
intel_iommu=on(Intel CPU)或amd_iommu=on(AMD CPU),然后更新GRUB配置并重启。你可以通过dmesg | grep -e IOMMU命令验证IOMMU是否成功加载。 - 禁用Nouveau驱动:Nouveau是许多Linux发行版默认搭载的开源NVIDIA驱动,它会与官方驱动冲突。你需要在
/etc/modprobe.d/blacklist.conf文件中添加一行blacklist nouveau,然后更新initramfs并重启。在某些较新的系统上,系统可能已经自动安装了其他NVIDIA开源驱动包,也需要一并移除。 - 安装编译依赖:安装驱动需要在主机上编译内核模块,因此务必先安装
gcc、make和当前内核的开发包(如在RHEL系中为kernel-devel,在SUSE中为kernel-default-devel)。 - 清理旧驱动:如果系统之前安装过其它NVIDIA驱动(如桌面版驱动),需要先彻底卸载,以免产生冲突。
- 开启IOMMU:在GRUB启动参数中添加
🚀 安装 vGPU Manager 驱动
完成上述准备工作并确认系统环境无误后,即可开始安装Host端驱动。首先获取文件,如果获取不到可以尝试到github仓库vgpu-chinese-mirror找到对应驱动文件进行下载。
-
退出图形界面:为确保安装顺利进行,建议退出图形界面(如有),将系统切换至运行级别3:
sudo init 3 -
赋予执行权限:
chmod +x NVIDIA-Linux-x86_64-595.91.04-vgpu-kvm.run -
执行安装程序:
- 推荐方式:使用
--dkms参数,这样当系统内核更新时,NVIDIA内核模块会自动重建,避免手动干预。sudo ./NVIDIA-Linux-x86_64-595.91.04-vgpu-kvm.run --dkms - 标准方式:直接运行安装程序。
sudo ./NVIDIA-Linux-x86_64-595.91.04-vgpu-kvm.run
安装过程中,安装程序可能会提示一系列选项(如是否注册DKMS等),通常选择“是”或“OK”即可。详细的安装日志会保存在
/var/log/nvidia-installer.log文件中,若安装失败,可查看此日志排查问题。 - 推荐方式:使用
-
重启主机:
驱动安装完成后,建议重启主机以确保所有内核模块正确加载。sudo reboot
✅ 验证安装
重启后,通过以下命令验证驱动是否安装成功:
-
检查NVIDIA内核模块:
lsmod | grep nvidia输出中应包含
nvidia_vgpu_vfio等关键模块。 -
使用
nvidia-smi命令:
这是最直接的验证方式,命令应成功运行并显示物理GPU的型号、驱动版本和状态信息。nvidia-smi
📝 后续关键步骤
vGPU Manager安装完成仅仅是第一步。 要让虚拟机使用vGPU,后续还有一系列不可或缺的步骤:
-
配置NVIDIA vGPU许可:NVIDIA vGPU是商业产品,所有vGPU功能都需要通过许可证授权才能使用。你需要搭建一个NVIDIA License Server,并在主机或虚拟机内进行配置。
-
为虚拟机安装Guest驱动:在需要分配vGPU的虚拟机内部,需要安装另一个专用于Guest OS的NVIDIA驱动。该驱动的版本必须与主机端的vGPU Manager版本兼容。注意,Guest驱动文件名通常不同,例如是
NVIDIA-Linux-x86_64-*-grid.run格式。Guest驱动的安装过程与Host类似,但通常在虚拟机内部完成,且需要确保dkms等依赖包也已安装。 -
创建并分配vGPU设备:你需要通过修改虚拟机的libvirt XML配置文件,为其添加一个
mdev(mediated device)设备,也就是vGPU。首先,可以通过以下命令查看物理GPU支持的vGPU Profile列表:grep -H . /sys/bus/pci/devices/$VF/mdev_supported_types/*/name(需将
$VF替换为实际的设备路径)
然后,在虚拟机的XML配置文件中添加对应的<hostdev>和<interface>配置,指定vGPU的Profile类型(如nvidia-xx)。完成后,即可启动虚拟机享用vGPU加速能力。
openEuler 是由开放原子开源基金会孵化的全场景开源操作系统项目,面向数字基础设施四大核心场景(服务器、云计算、边缘计算、嵌入式),全面支持 ARM、x86、RISC-V、loongArch、PowerPC、SW-64 等多样性计算架构
更多推荐

所有评论(0)