Вместе с нами тебе предстоит:
Приём, анализ и обработка обращений в техническую поддержку (L2-уровень).
Мониторинг состояния сервисов, инфраструктурных контуров и ключевых метрик производительности.
Анализ логов: инфраструктурных, системных и прикладных — с использованием инструментов ELK, Grafana Loki и др.
Диагностика инцидентов, локализация причин сбоев, взаимодействие с командой развития.
Обновление системного и прикладного программного обеспечения в рамках регламентов эксплуатации.
Проведение обновлений ОС (Linux) и патчей ПО в соответствии с регламентами эксплуатации (релизы, хот фиксы).
Участие в релизном цикле.
Подготовка к выводу изменений в прод.
Контроль корректности развертывания и проверка работоспособности после релиза.
Проверка эксплуатационной и технической документации.
Работа над улучшением SLA/SLO: анализ частоты и причин инцидентов, предложение и реализация мер по повышению надёжности.
Автоматизация рутинных задач: написание скриптов, интеграция с системами мониторинга.
Наши технологии:
Виртуализация: VMware vSphere, OpenStack.
Контейнеризация: Docker, Kubernetes (K8s).
Хранилища: PostgreSQL, MinIO.
Управление доступом: Keycloak, Active Directory.
CI/CD и управление кодом: GitLab.
Мониторинг: Prometheus + Grafana, Zabbix.
Логирование: ELK-стек / Loki + Grafana.
Инструменты: Jira, Confluence.
Управление релизами в K8s: HELM.
Какие знания и навыки для нас важны:
Уверенное владение Linux (консоль, диагностика, базовые компоненты ОС); используемые дистрибутивы: Ubuntu Server, Astra Linux.
Опыт работы с systemd, journald, tcpdump, strace.
Понимание сетевых основ (TCP/IP, DNS, TLS).
Навыки написания простых bash/python-скриптов.
Понимание работы микросервисной архитектуры, умение работать и диагностировать Docker, K8s.
Понимание жизненного цикла инцидента.
Опыт работы с логами.
Опыт настройки и работы с системами мониторинга Grafana, Prometheus, Zabbix.
Базовый опыт работы с СУБД: - просмотр данных и логов; - выполнение точечных SQL-запросов (PostgreSQL).
Опыт работы с Camunda (процессы, диагностика процессов, анализ логов).
Интерес и желание развиваться в сторону DevOps / SRE.
Готовность разбираться в причинах проблем, а не только «закрывать тикеты».
Будет плюсом:
Воронеж
до 300000 RUR
Воронеж
от 130000 RUR