Облачная платформаAdvanced

Перезапуск Cluster

Язык статьи: Русский
Показать оригинал
Страница переведена автоматически и может содержать неточности. Рекомендуем сверяться с английской версией.

Перезапуск cluster может потребоваться для таких целей, как обновление конфигурации или восстановление после сбоя. Кластеры CSS OpenSearch поддерживают два режима перезапуска: quick restart и rolling restart. Чтобы сбалансировать доступность кластера и эффективность перезапуска, выберите режим, наиболее соответствующий вашим эксплуатационным требованиям.

Сравнение двух режимов перезапуска

Table 1 Введение двух режимов перезапуска

Режим перезапуска

Quick Restart

Rolling Restart

Влияние

Высокий:

Кластер становится недоступным для операций чтения и записи на весь период обновления.

Низкий:

Недоступен только node, который перезапускается. Кластер в целом остаётся доступным всё время.

Как это работает

Параллельные операции: все выбранные nodes останавливаются и перезапускаются одновременно.

Последовательные операции: Перезапустить node A → Дождаться его восстановления → Перезапустить node B → Дождаться его восстановления и т.д.

Безопасность данных

Существует риск потери данных, если принудительно перезапустить узлы, которые всё ещё обслуживают запросы на запись.

Безопасность данных гарантируется, поскольку система автоматически управляет распределением шардов.

Требуемое время

Все узлы перезапускаются одновременно. Общее время перезапуска обычно короче.

Выбранные узлы перезапускаются поочерёдно. После первого узла каждый последующий может перезапуститься только после полного восстановления предыдущего узла. Этот процесс занимает больше времени.

Когда использовать

Используйте этот режим в средах разработки или тестирования, где кластеры полностью блокированы, или когда допустимы перебои в работе сервиса.

Используйте этот режим в производственных средах, где высокая доступность имеет первостепенное значение, а кластеры хранят большие объёмы данных.

Количество узлов

Нет ограничения на количество узлов.

Не менее трёх узлов.

Ограничения

Кластеры, у которых Task Status имеет значение Frozen или которые имеют текущие задачи, нельзя перезапустить.

Перед началом

  • Проверьте статус здоровья целевого кластера. Проверьте столбец Task Status, чтобы убедиться, что нет текущих задач.
  • Приостановите задачи высококонкурентного ввода данных, чтобы предотвратить ошибки записи, вызванные изменениями primary shard во время перезапуска.
  • Избегайте перезапуска кластера в пиковые часы, так как это может повлиять на целостность данных и доступность сервиса.
  • Перед выполнением rolling restart проверьте, что у индексов настроена хотя бы одна реплика.

Quick Restart

  1. Войдите в консоль управления CSS.
  2. В панели навигации слева выберите Clusters > OpenSearch.
  3. В списке кластеров найдите целевой кластер и выберите More > Restart в столбце Operation.
  4. On the Restart Cluster page, set parameters.
    Table 2 Настройка быстрого перезапуска

    Parameter

    Description

    Restart Mode

    Select Quick Restart.

    Select By

    Выберите Node type или Node name.

    • Node type: Выберите один или несколько типов узлов для перезапуска. Например, с помощью этой опции можно перезапустить все клиентские узлы, чтобы освободить соединения.
    • Node name: Перезапускайте только один узел за раз. Используйте эту опцию для перезапуска отдельных узлов, например, для восстановления неисправных узлов.

    Значение

    Выберите один или несколько типов узлов или имя узла, в зависимости от настройки Select By.

  5. Вручную введите YES и нажмите OK, чтобы запустить задачу перезапуска.
    Warning

    Кластер будет недоступен в течение всего времени быстрого перезапуска.

  6. Когда статус кластера меняется с Processing на Available, кластер успешно перезапущен.

Rolling Restart

  1. Войдите в консоль управления CSS.
  2. В панели навигации слева выберите Clusters > OpenSearch.
  3. В списке кластеров найдите целевой кластер и выберите More > Restart в столбце Operation.
  4. На странице Restart Cluster задайте параметры.
    Table 3 Настройка постепенного перезапуска

    Параметр

    Описание

    Режим перезапуска

    Выберите Rolling Restart.

    Эта опция недоступна, когда в кластере менее трех узлов.

    Выбор по

    Значение по умолчанию — Node type.

    Значение

    Выберите типы узлов для перезапуска.

    • Select all: Выберите все типы узлов.
    • Выберите конкретные типы узлов: например, чтобы перезапустить узлы холодных данных, выберите только Cold Data Nodes. Система пропустит все остальные узлы.
  5. Вручную введите YES и нажмите OK, чтобы запустить задачу перезапуска.
  6. Когда статус кластера меняется с Processing на Available, кластер успешно перезапущен.

FAQ

  • Вопрос 1: Что делать, если rolling restart завис в состоянии Restarting надолго?

    Во время rolling restart после перезапуска последнего узла система ожидает восстановления кластера (статус здоровья становится зеленым/желтым). Если в кластере находятся чрезвычайно большие индексы или шардов индексов всё ещё восстанавливаются, задача может зависнуть в состоянии Restarting надолго. Вы можете выполнить команду GET _cat/recovery?v, чтобы проверить прогресс восстановления шардов.

  • Вопрос 2: Как выполнить перезапуск, похожий на rolling, в кластере, состоящем всего из двух узлов?

    Опция rolling restart недоступна для кластеров, состоящих всего из двух узлов, но вы можете выполнить аналогичный процесс вручную:

    1. Проверьте количество реплик индексов. Чтобы обеспечить непрерывность сервиса, убедитесь, что каждый индекс имеет хотя бы одну реплику.
    2. Выберите Fast Restart, затем выберите Node name для Select By. Выберите один из узлов для его перезапуска.
    3. Дождитесь полного восстановления этого узла и изменения статуса кластера на Available. Затем перезапустите другой узел.