Специалист мониторинга и дежурной службы эксплуатации

Специалист мониторинга и дежурной службы эксплуатации

Описание вакансии

Крупная российская компания с развитым бизнесом и собственными IT-решениями. Мы создаём и развиваем цифровые продукты, автоматизируем бизнес-процессы и внедряем современные технологии.

Работаем над масштабными задачами, где IT напрямую влияет на развитие бизнеса.

Ищем специалиста для работы в круглосуточной дежурной службе: вы будете первой линией защиты стабильности сервисов — оперативно фиксировать алерты, проводить первичную диагностику, запускать процессы реагирования и помогать держать доступность систем на целевом уровне. Роль предполагает чёткое следование регламентам, работу в стрессовых ситуациях и постоянное взаимодействие со смежными командами. Вы станете частью команды, которая не просто «гасит пожары», а снижает количество инцидентов за счёт аккуратной настройки мониторинга, актуализации инструкций и улучшения наблюдаемости.

Задачи

  • Оперативно реагировать на алерты в рамках SLA: регистрировать инциденты, выполнять первичную диагностику (логи, метрики, базовые проверки), запускать эскалацию по матрице, координировать вовлечённые команды, контролировать закрытие.
  • Выполнять типовые эксплуатационные операции по регламенту: перезапуски сервисов, проверку доступности, очистку временных файлов, контроль дискового пространства, проверку статусов реплик и очередей.
  • Настраивать и поддерживать базовые элементы мониторинга: добавлять простые алерты и пороги, проверять корректность сбора метрик, помогать снижать «шум» (ложные срабатывания), актуализировать runbooks и инструкции для дежурных.
  • Собирать и фиксировать данные по инцидентам: описывать симптомы, шаги диагностики, причину, принятые меры, эффект; формировать краткие отчёты для разбора и базы знаний.
  • Взаимодействовать со смежными командами (разработка, DevOps, SRE, поддержка): передавать детали проблемы, уточнять сроки исправления, согласовывать откаты или временные решения.
  • Участвовать в учениях и разборах инцидентов (post‑mortem): помогать фиксировать выводы, предлагать простые улучшения процессов и проверок.
  • Вести и актуализировать документацию: регламенты дежурств, чек‑листы, матрицы эскалации, инструкции по типовым сценариям.
  • Следить за окнами релизов и плановых работ: проверять контрольные точки мониторинга, фиксировать отклонения, при необходимости запускать эскалацию.

Требования

  • Опыт работы в эксплуатации, дежурной службе или поддержке от 1–2 лет, понимание процессов 24×7 и базовых принципов SLA.
  • Уверенное владение инструментами мониторинга и алертинга (Prometheus, Grafana, Zabbix, Nagios, ELK/Loki или аналоги) и умение читать дашборды и алерты.
  • Практические навыки работы в Linux: навигация по файловой системе, просмотр логов, проверка сетевых соединений, анализ загрузки CPU/памяти/диска, диагностика простых проблем.
  • Понимание сетевых основ (TCP/IP, DNS, HTTP, базовые фаерволы) и того, как сетевые проблемы отражаются в метриках и логах.
  • Умение чётко и кратко описывать проблему и действия: писать понятные инциденты и комментарии для других инженеров.
  • Хорошие коммуникативные навыки: способность спокойно и структурированно общаться в стрессовой ситуации, задавать правильные вопросы смежным командам.
  • Готовность к дежурствам и оперативному включению в инциденты, в том числе в нерабочее время.

Что предлагаем

  • Конкурентную заработную плату — уровень дохода обсуждаем индивидуально с учётом опыта и экспертизы
  • ДМС — заботимся о здоровье сотрудников и предоставляем расширенные программы
  • Обучение и развитие — доступ к курсам, профессиональным программам и внутреннему обучению
  • Карьерный рост — возможности развиваться в своей специализации и переходить на новые направления
  • Интересные IT-задачи — участие в проектах, которые напрямую влияют на развитие крупного бизнеса
  • Современный стек и технологии — возможность работать с актуальными инструментами и подходами
  • Гибкий формат работы — обсуждаем удобный формат взаимодействия в зависимости от позиции и задач
  • Сильная команда — работа с опытными специалистами из IT и смежных бизнес-направлений
  • Стабильность — крупная компания с масштабными проектами и долгосрочными планами развития
  • Корпоративные бонусы — скидки на продукцию компании и дополнительные программы для сотрудников
  • Комфортные условия работы — современная рабочая среда, необходимые инструменты и всё для эффективной работы
Посмотреть контакты работодателя

Похожие вакансии

Ведущий специалист мониторинга и дежурной службы эксплуатации

Крупная российская компания с развитым бизнесом и собственными IT-решениями

  • Москва

  • Не указана

Рекомендуем

Специалист технической поддержки

Глобал Интернет Решения

  • Москва

  • до 150000 RUR

Рекомендуем

Специалист технической поддержки сайта

Крупная российская компания с развитым бизнесом и собственными IT-решениями

  • Москва

  • до 150000 RUR

Рекомендуем
МТС Банк
  • Москва

  • от 120000 RUR

Оптимальные системы
  • Москва

  • до 60000 RUR

Агентство Сила различий

Специалист клиентской поддержки

Агентство Сила различий

  • Москва

  • до 80000 RUR

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию