Облачная платформаAdvanced

Перезапуск кластера

Язык статьи: Русский
Показать оригинал
Страница переведена автоматически и может содержать неточности. Рекомендуем сверяться с английской версией.

Перезапуск кластера может потребоваться для таких целей, как обновление конфигурации или восстановление после сбоя. Кластеры CSS Elasticsearch поддерживают два режима перезапуска: quick restart и rolling restart. Чтобы сбалансировать доступность кластера и эффективность перезапуска, выберите режим, наиболее соответствующий вашим эксплуатационным требованиям.

Сравнение двух режимов перезапуска

Table 1 Представление двух режимов перезапуска

Режим перезапуска

Quick Restart

Rolling Restart

Влияние

Высокий:

Кластер становится недоступным для операций чтения и записи на весь период обновления.

Низкий:

Недоступен только узел, который перезапускается. Кластер в целом остаётся доступным всё время.

Как это работает

Параллельные операции: все выбранные узлы останавливаются и перезапускаются одновременно.

Последовательные операции: Перезапустить узел A > Дождаться его восстановления > Перезапустить узел B > Дождаться его восстановления, и т.д.

Безопасность данных

Существует риск потери данных, если принудительно перезапустить узлы, которые всё ещё обслуживают запросы на запись.

Безопасность данных гарантируется, поскольку система автоматически управляет распределением шардов.

Требуемое время

Все узлы перезапускаются одновременно. Общее время перезапуска обычно короче.

Выбранные узлы перезапускаются поочерёдно. После первого узла каждый последующий может перезапуститься только после полного восстановления предыдущего узла. Этот процесс занимает больше времени.

Когда использовать

Используйте этот режим в средах разработки или тестирования, где кластеры полностью блокированы, или когда допустим простой сервиса.

Используйте эту модель в производственных средах, где высокая доступность имеет первостепенное значение, а кластеры хранят большие объёмы данных.

Количество узлов

Нет ограничения на количество узлов.

Не менее трёх узлов.

Ограничения

Кластеры, у которых Task Status равен Frozen или которые имеют текущие задачи, не могут быть перезапущены.

Перед началом

  • Проверьте состояние здоровья целевого кластера. Проверьте столбец Task Status, чтобы убедиться, что нет текущих задач.
  • Приостановите задачи высококонкурентного ввода данных, чтобы предотвратить ошибки записи, вызванные изменениями primary shard во время перезапуска.
  • Избегайте перезапуска кластера в пиковые часы, так как это может повлиять на целостность данных и доступность сервиса.
  • Перед выполнением rolling restart проверьте, что у индексов настроена как минимум одна реплика.

Quick Restart

  1. Войдите в консоль управления CSS.
  2. В панели навигации слева выберите Clusters > Elasticsearch.
  3. В списке кластеров найдите целевой кластер и выберите More > Restart в столбце Operation.
  4. На странице Restart Cluster задайте параметры.
    Table 2 Настройка Quick Restart

    Parameter

    Description

    Restart Mode

    Выберите Quick Restart.

    Select By

    Выберите Node type или Node name.

    • Node type: Выберите один или несколько типов узлов для перезапуска. Например, можно использовать эту опцию для перезапуска всех клиентских узлов с целью освобождения соединений.
    • Node name: Перезапускайте только один узел за раз. Используйте эту опцию для перезапуска отдельных узлов, например, для восстановления неисправных узлов.

    Operation Value

    Выберите один или несколько типов узлов или имя узла, в зависимости от настройки Select By.

  5. Вручную введите YES, и нажмите OK, чтобы запустить задачу перезапуска.
    Warning

    Кластер будет недоступен в течение всего времени быстрого перезапуска.

  6. Когда статус кластера меняется с Processing на Available, кластер успешно перезапущен.

Rolling Restart

  1. Войдите в консоль управления CSS.
  2. В левой панели навигации выберите Clusters > Elasticsearch.
  3. В списке кластеров найдите целевой кластер и выберите More > Restart в столбце Operation.
  4. На странице Restart Cluster задайте параметры.
    Table 3 Настройка последовательного перезапуска

    Параметр

    Описание

    Режим перезапуска

    Выберите Rolling Restart.

    Эта опция недоступна, когда в кластере менее трех узлов.

    Выбрать по

    Значение по умолчанию — Node type.

    Значение

    Выберите типы узлов для перезапуска.

    • Select all: Выберите все типы узлов.
    • Выберите конкретные типы узлов: например, чтобы перезапустить узлы холодных данных, выберите Cold Data Nodes только. Система пропустит все остальные узлы.
  5. Manually type in YES, and click OK to start the restart task.
  6. Когда статус кластера меняется с Processing на Available, кластер успешно перезапущен.

FAQ

  • Вопрос 1: Что делать, если rolling restart застрял в Restarting надолго?

    Во время rolling restart после перезапуска последнего узла система ожидает восстановления кластера (статус здоровья становится зеленым/желтым). Если в кластере находятся чрезвычайно большие индексы или фрагменты индексов всё ещё восстанавливаются, задача будет зависать в Restarting надолго. Вы можете выполнить команду GET _cat/recovery?v, чтобы проверить прогресс восстановления фрагментов.

  • Вопрос 2: Как выполнить rolling-like перезапуск в кластере, состоящем всего из двух узлов?

    Опция rolling restart недоступна для кластеров, состоящих всего из двух узлов, но вы можете выполнить аналогичный процесс вручную:

    1. Проверьте количество реплик индексов. Чтобы обеспечить непрерывность сервиса, убедитесь, что каждый индекс имеет как минимум одну реплику.
    2. Выберите Fast Restart, затем выберите Node name для Select By. Выберите один из узлов для его перезапуска.
    3. Дождитесь полного восстановления этого узла и изменения статуса кластера на Available. Затем перезапустите другой узел.