В этом разделе показано, как найти причину сбоя, когда кластер становится недоступным.
Возможные причины перечислены в порядке вероятности.
Проверяйте эти причины одну за другой, пока не найдёте причину сбоя.
Если сбой сохраняется, обратитесь в службу поддержки, чтобы помочь вам найти причину сбоя.
Имя этой security group имеет формат {cluster_name}-cce-control-{ID}.
Подробности см. How Do I Modify Cluster Security Group Rules?
Симптом
Использование ресурсов на master nodes в кластере достигает 100%.
Возможная причина
Когда в кластере одновременно создаётся большое количество ресурсов, это приводит к перегрузке API server. Это, в свою очередь, перегружает master nodes и приводит к проблемам OOM.
Решение
Увеличьте масштаб управления кластером. Более крупный масштаб управления кластером означает большую ёмкость и повышенную производительность master nodes. Для получения подробной информации см. Changing a Cluster Scale.
Если кластер перегружен, вы можете отправить service ticket для получения технической поддержки.