В инструкции описана установка плагина NVIDIA GPU Operator в кластер и проверка поддержки CUDA.
В личном кабинете перейдите в кластер, для которого создали группу узлов с GPU.
Перейдите в раздел Плагины и справа над списком установленных плагинов нажмите Добавить плагин.
Выберите NVIDIA GPU Operator.
Выберите необходимую версию NVIDIA GPU Operator.
Для моделей GPU с NVlink требуется версия NVIDIA GPU Operator 26.3.3 и выше.
Нажмите Установить и подтвердите действие.
Дождитесь, когда состояние плагина изменится на «Установлен».
Для тестирования корректной работы плагина развернем небольшое приложение CUDA, выполняющее простое сложение векторов.
Создайте спецификацию cuda-vector-add.yaml:
apiVersion: v1kind: Podmetadata:name: cuda-vector-addspec:restartPolicy: OnFailurecontainers:- name: cuda-vector-addimage: "emk8s.cr.cloud.ru/nvidia/cuda-vector-add:v0.1"resources:limits:nvidia.com/gpu: 1
Создайте под:
kubectl create -f cuda-vector-add.yaml
Проверьте логи:
kubectl logs -f cuda-vector-add
Результат:
[Vector addition of 50000 elements]Copy input data from the host memory to the CUDA deviceCUDA kernel launch with 196 blocks of 256 threadsCopy output data from the CUDA device to the host memoryTest PASSEDDone