Облачная платформаAdvanced

Как определить коренную причину, если рабочая нагрузка аномальна?

Язык статьи: Русский
Показать оригинал
Страница переведена автоматически и может содержать неточности. Рекомендуем сверяться с английской версией.

Если рабочая нагрузка аномальна, сначала можно проверить pod events, чтобы определить причину, а затем исправить её.

Определение неисправности

Чтобы определить причину аномальной рабочей нагрузки, выполните следующие действия:

  1. Проверьте, работает ли pod рабочей нагрузки правильно.

    1. Войдите в консоль CCE.
    2. Нажмите имя кластера, чтобы открыть консоль кластера. В панели навигации выберите Workloads.
    3. В левом верхнем углу страницы выберите пространство имён, найдите целевую рабочую нагрузку и просмотрите её статус.
      • Если рабочая нагрузка не готова, вы можете просмотреть pod events, чтобы определить причину. Подробности см. Viewing Pod Events. Решение проблемы можно найти на основе событий, обратившись к Common Pod Issues.
      • Если рабочая нагрузка обрабатывается, подождите.
      • Если рабочая нагрузка запущена, но недоступна, проверьте, нормален ли доступ внутри кластера.

  2. Проверьте, нормален ли доступ внутри кластера.

    Войдите в консоль CCE или используйте kubectl, чтобы получить IP‑адрес pod. Затем войдите в узел или pod и выполните curl или используйте другие методы для ручного вызова API и проверьте, возвращён ли ожидаемый результат.

    Если {Container IP address}:{Port number} недоступен, войдите в сервисный контейнер и попытайтесь получить доступ к 127.0.0.1:{Port number}.

  3. Проверьте, отображаются ли ожидаемые результаты.

    Если рабочая нагрузка доступна внутри кластера, но ожидаемые результаты не отображаются, проверьте конфигурацию рабочей нагрузки, например, убедитесь, что image tag и environment variables настроены правильно.

Общие проблемы Pod

Статус

Описание

Ссылка

Pending

Планирование pod не удалось.

Что делать, если планирование Pod не удалось?

Pending

Не удалось смонтировать storage volume к pod.

Что делать, если storage volume не может быть смонтирован или монтирование завершается тайм‑аутом?

FailedPullImage

ImagePullBackOff

Не удалось выполнить image pull.

Повторный image pull не удался.

Что делать, если Pod не может загрузить образ?

CreateContainerError

CrashLoopBackOff

Запуск контейнера не удался.

Перезапуск контейнера не удался.

Что делать, если запуск Pod не удался?

Evicted

Pod находится в состоянии Evicted, и pod продолжает выселяться.

Что делать, если Pod не может быть выселен?

Creating

Pod находится в состоянии Creating.

Что делать, если рабочая нагрузка остаётся в состоянии Creating?

Terminating

Pod находится в состоянии Terminating.

Что делать, если Pod остаётся в состоянии Terminating?

Stopped

Pod находится в состоянии Stopped.

Что мне делать, если Workload остановлен из‑за удаления Pod?

Просмотр событий Pod

Метод 1

В консоли CCE нажмите название workload, чтобы перейти на страницу сведений о workload, найдите строку, содержащую аномальный pod, и выберите More > View Events в столбце Operation.

Метод 2

Используйте команду kubectl:

kubectl describe pod {pod-name}

Отображается информация, аналогичная следующей:

...
Events:
Type Reason Age From Message
---- ------ ---- ---- -------
Warning FailedScheduling 49s default-scheduler 0/2 nodes are available: 2 Insufficient cpu.
Warning FailedScheduling 49s default-scheduler 0/2 nodes are available: 2 Insufficient cpu.