Минск
Метро: КупаловскаяУправление инцидентами (L2/L3), эскалация и оперативное решение проблем
Анализ логов и метрик (ELK, Zabbix и др.)
Поддержка сервисов и участие в разборе инцидентов в продакшене
Сопровождение релизов, контроль изменений
Работа с PostgreSQL (диагностика, анализ данных, SQL-запросы)
Настройка мониторинга, определение критичных метрик и алертов
Контроль и участие в формировании SLI / SLO
Взаимодействие с разработчиками при поиске причин инцидентов
Проведение постмортем‑анализа и улучшение стабильности систем
Ведение задач в Jira, документации в Confluence
Опыт работы в роли SRE / Production Support / L2-L3 Engineer от 2 лет
Понимание принципов SLI / SLO и incident management
Опыт работы с мониторингом (Zabbix, Prometheus или аналогичные системы)
Уверенную работу с реляционными БД (PostgreSQL)
Опыт работы с облаками (AWS / Yandex Cloud / Selectel)
Будет плюсом
Дежурства (без ночных смен, раз в 3 недели)