ОБЯЗАННОСТИ
Участвовать в дежурствах:
-реагировать на инциденты, проблемы клиентов (переданные со второй линии поддержки) и оповещения мониторинга;
-проводить диагностику, выявлять причины сбоев и восстанавливать работу сервиса. Участвовать в разборе корневых причин инцидентов;
Формировать документацию и инструкции для инженеров поддержки 3-го и 2-го уровней;
Вместе с инженерами SRE работать над повышением надёжности системы (мониторинг и пр.)
ТРЕБОВАНИЯ
Имеет опыт сопровождения критических информационных систем и инфраструктуры (чем сложнее – тем лучше);
Имеете уверенные знания и опыт администрирования Linux;
Имеете базовые знания в области сетевых технологий;
Обладаете знаниями о контейнеризации и k8s;
Знакомы с инструментами мониторинга и логирования (Zabbix / Prometheus, / Grafana / ELK);
Не теряетесь в критической ситуации и можете планомерно работать над поиском причины неисправности и её устранением;
Хотите активно учиться и развиваться.
УСЛОВИЯ
Работа в Cloud.ru — это:
Комфортная среда
Место, где ты растешь
Крутая команда
Еще у нас
Подходит вакансия?
Оставь нам свое резюме и контактные данные