Обязанности: - Контроль состояния сервисов и алертов в зонтичной системе мониторинга (ЗСМ) по закреплённым контурам и функциональным слоям;
- Оценка влияния событий на сервисы по данным ЗСМ: выделение инцидентов, требующих немедленной реакции, и алертов без текущего влияния на сервис — для разбора в рабочее время;
- Контроль корректности назначения инцидентов дежурными сменами эксплуатации (ДС); возврат при ошибочном назначении; основное взаимодействие — с ДС эксплуатационных групп и сервис‑менеджерами;
- Эскалация инцидентов при нарушении сроков или отсутствии реакции от ответственной команды, фиксация факта и времени эскалации;
- Контроль хода устранения инцидентов, соблюдения SLA/OLA, запрос обновлений при задержках;
- Выявление и фиксация флапающих событий, эскалация в команду мониторинга или разработки для стабилизации;
- Регистрация сбоев и багов ЗСМ: события без реальной неисправности, отсутствие алертов, задержки данных, ошибки корреляции — сбор артефактов и передача в профильную команду;
- Координация коммуникаций при авариях: ведение единого канала статусов, обеспечение своевременных обновлений для ДС, сервис‑менеджеров и заинтересованных команд;
- Сбор данных о плановых работах из разных систем, формирование и публикация сводного календаря изменений, заблаговременное информирование о рисках и пересечениях;
- Ведение журнала дежурств: ключевые события, эскалации, флапы, сбои ЗСМ, нестандартные ситуации — для преемственности между сменами;
- Участие в актуализации инструкций и базы знаний: фиксация отклонения от типовых сценариев, предложение корректировок чек‑листов и инструкций для дежурных.
Требования: - Высшее образование;
- Опыт работы в ИТ‑эксплуатации, сопровождении сервисов или техподдержке;
- Опыт работы с системами мониторинга (Zabbix, Prometheus, Scada и др.);
- Опыт работы с ITSM‑системами;
- Понимание жизненного цикла инцидента и принципов эскалации;
- Базовые знания ИТ‑инфраструктуры: сети, серверы, виртуализация, контейнеризация;
- Умение кратко и ясно формулировать техническую информацию, грамотно вести записи и статусы.
Условия: - Официальное трудоустройство по ТК РФ в аккредитованную IT-компанию;
- Стабильный «белый» доход и полноценный социальный пакет;
- Сменный график работы с дневными и ночными сменами (2/2 - день, ночь, отсыпной, выходной);
- Работа в Ситуационном центре по адресу: м.Ховрино, Коровинское ш, 41;
- Корпоративный университет для внутреннего и внешнего профильного обучения;
- Отличные перспективы карьерного роста – горизонтального и вертикального.
А также для Вас:
- Программа ДМС с обслуживанием в лучших клиниках города;
- Корпоративные команды по футболу, волейболу, бегу, а также скидки на фитнес-абонементы;
- Эксклюзивная программа корпоративных привилегий и скидок Primezone;
- Корпоративная мобильная связь.
Работая вместе с нами, Вы сможете принять участие в амбициозных, крупных проектах, значимых для страны!