설치 절차
STEP1. 공식 NVIDIA 리포지토리 추가 #
Rocky Linux 9용 공식 NVIDIA CUDA 리포지토리를 시스템에 등록합니다. 다음 명령을 실행하면 CUDA(NVIDIA) 리포지토리가 추가됩니다.
sudo dnf config-manager --add-repo \
http://developer.download.nvidia.com/compute/cuda/repos/rhel9/$(uname -i)/cuda-rhel9.repo
실행 후, NVIDIA 리포지토리 정의 파일이 /etc/yum.repos.d/에 추가되며, 이후 이 리포지토리에서 패키지를 설치할 수 있게 됩니다.
#
STEP2. 필수 패키지 설치 #
NVIDIA 드라이버를 빌드하고 CUDA를 사용하는 데 필요한 개발 패키지를 설치합니다. 먼저 EPEL(Extra Packages for Enterprise Linux) 리포지토리와 개발 패키지를 포함하는 CRB(CodeReady Builder) 리포지토리를 활성화합니다.
이렇게 하면 dkms와 같은 필요한 구성 요소를 사용할 수 있게 됩니다.
sudo dnf config-manager --set-enabled crb
sudo dnf install -y \
https://dl.fedoraproject.org/pub/epel/epel-release-latest-9.noarch.rpm \
https://dl.fedoraproject.org/pub/epel/epel-next-release-latest-9.noarch.rpm다음으로 현재 실행 중인 커널에 대응하는 커널 헤더 및 개발 패키지와 개발 도구를 설치합니다.
다음 명령을 실행하면 커널 헤더, 커널 개발 패키지(kernel-devel), 컴파일러(gcc/g++), DKMS 등 필요한 도구가 설치됩니다($(uname -r)는 현재 커널 버전으로 치환됩니다).
sudo dnf install -y kernel-headers-$(uname -r) kernel-devel-$(uname -r) \
make automake gcc gcc-c++ dkms pciutils elfutils-libelf-devel \
libglvnd-devel libglvnd-opengl libglvnd-glx bzip2 tar pkgconfig acpid참고: 위 명령은 현재 실행 중인 커널 버전에 맞는 커널 헤더 및 개발 패키지를 지정합니다. 이는 Rocky Linux 9.3의 기본 커널인
5.14.0-362.8.1.el9_3.x86_64에 맞춰 설치되며, 이후 이 커널에 대해 모듈을 빌드할 수 있게 됩니다. 필요한 패키지를 미리 설치해 두면 이후의 드라이버 설치가 원활하게 진행됩니다.
STEP3. NVIDIA 드라이버 설치 #
DNF 모듈 기능을 사용하여 최신 NVIDIA 드라이버를 설치합니다. 추가한 NVIDIA 리포지토리에는 여러 드라이버 모듈 스트림이 포함되어 있지만, 여기서는 최신 DKMS 버전 드라이버를 선택합니다. 다음 명령으로 NVIDIA 드라이버를 설치합니다.
sudo dnf module install -y nvidia-driver:latest-dkms실행 중 GPG 키 가져오기 확인이 표시되면 “y“를 입력하여 수락합니다.
이렇게 하면 DKMS를 통해 NVIDIA 커널 모듈이 빌드 및 설치되어 시스템에 통합됩니다. 설치가 완료되면 modinfo nvidia 명령으로 드라이버 모듈 정보를 확인할 수 있습니다.
STEP4. CUDA 12.8 설치 #
NVIDIA CUDA Toolkit 12.8을 설치합니다. CUDA 리포지토리에는 여러 CUDA 관련 메타패키지가 포함되어 있지만, 개발에 필요한 도구를 모두 포함하는 cuda-toolkit-12-8 패키지를 사용합니다(여기에는 CUDA 12.8 컴파일러와 라이브러리가 포함되지만 드라이버는 포함되지 않습니다).
다음 명령을 실행하여 CUDA Toolkit 12.8을 설치합니다.
sudo dnf install -y cuda-toolkit-12-8위 명령을 실행하면 컴파일러(nvcc), CUDA 라이브러리, 헤더 등이 /usr/local/cuda-12.6/ 아래에 설치됩니다.
CUDA bin 디렉터리를 PATH 환경 변수에 추가하려면, 예를 들어 echo 'export PATH=/usr/local/cuda-12.6/bin:$PATH' >> ~/.bashrc와 같이 설정합니다(필요한 경우 LD_LIBRARY_PATH도 설정합니다).
STEP5. 시스템 설정 적용 및 동작 확인 #
드라이버를 적용하기 위해 시스템을 재시작하고, 지정된 커널로 부팅되도록 설정합니다. 먼저 설치된 커널 중 5.14.0-362.8.1.el9_3.x86_64 버전 커널로 기본 부팅되도록 GRUB을 설정합니다. 다음 명령을 실행하여 적절한 커널을 기본 부팅 항목으로 설정합니다.
sudo grubby --set-default /boot/vmlinuz-5.14.0-362.8.1.el9_3.x86_64위 명령 실행 후, grubby --default-index 또는 grubby --info=ALL을 사용하여 기본값이 설정되었는지 확인할 수 있습니다. 다음으로 시스템을 재시작합니다. 재시작 후에는 먼저 커널 버전이 5.14.0-362.8.1.el9_3.x86_64인지 uname -r을 사용하여 확인합니다. 또한 만약을 위해 Nouveau 드라이버가 비활성화되어 있는지 확인합니다(필요한 경우 lsmod | grep nouveau의 출력이 없는지 확인합니다. 비활성화가 필요한 경우 blacklist nouveau를 /etc/modprobe.d/blacklist-nouveau.conf에 추가하고 dracut -f 명령으로 initramfs를 재빌드합니다).
마지막으로 NVIDIA GPU가 올바르게 인식되고 드라이버가 정상적으로 작동하는지 확인합니다. lspci 명령을 사용하여 GPU가 감지되는지 확인합니다(아래 명령을 실행하면 NVIDIA GPU 항목이 표시됩니다).
lspci | grep -i NVIDIA위 명령 결과로 “NVIDIA Corporation …” 항목이 표시되면 PCI 버스에서 GPU가 인식된 것입니다. 다음으로 nvidia-smi 명령을 실행하여 NVIDIA 드라이버 상태를 확인합니다.
nvidia-smi설치가 정상적으로 완료된 경우 GPU 목록, 드라이버 버전, 사용 가능한 메모리 등의 정보가 표시됩니다.
예를 들어 RTX 6000 Ada에 해당하는 드라이버가 올바르게 로드된 경우, GPU 이름과 사용 가능한 CUDA 버전이 표시됩니다. 이것으로 NVIDIA RTX 6000 Ada 드라이버 및 CUDA 12.6의 설치와 설정이 완료됩니다. 필요한 경우 다시 재시작하여 부팅 시 문제가 없는지 확인해 주십시오.
보충: lspci 및 nvidia-smi 확인에 대하여 #
lspci는 PCI 장치 목록을 표시하는 명령입니다. 위와 같이 실행하면 시스템이 NVIDIA GPU를 인식하고 있는지 확인할 수 있습니다.nvidia-smi는 설치된 드라이버가 정상적으로 작동하는지(즉, GPU를 인식하고 있는지) 확인할 수 있는 NVIDIA의 시스템 관리 유틸리티입니다.- 드라이버 설치 후 이 명령으로 GPU 정보를 확인할 수 있다면 설치가 성공한 것입니다.