Инженер SRE

Описание вакансии

Мы расширяем команду эксплуатации, которая поддерживает высоконагруженный рекомендательный движок. Наша система обрабатывает большие объемы данных в реальном времени и напрямую влияет на пользовательский опыт продукта. Сейчас команда состоит из 8 человек. Мы ищем специалиста, готового развиваться вместе с нами, погружаться в сложный технологический стек и обеспечивать стабильность сервисов.

Обязанности

  • поддерживать работоспособность инфраструктуры решения по выдаче рекомендаций под руководством старших инженеров
  • участвовать в раскатке сервисов на тестовые и продуктивные стенды через настроенные CI/CD пайплайны (GitLab, Jenkins, ArgoCD)
  • проводить мониторинг состояния систем (Prometheus, Loki, Grafana), первичный анализ алертов и логов при поступлении инцидентов от первой линии поддержки
  • решать баги инфраструктуры во время дежурств (on-call) и в штатном режиме
  • вносить изменения в инфраструктуру с помощью IaC-инструментов (Terraform, Helm-чарты) по готовым шаблонам и инструкциям
  • помогать в оптимизации конвейеров обработки данных (Airflow, Spark) и работе распределенных хранилищ (MongoDB, PostgreSQL, Redis)
  • писать простые скрипты автоматизации на Python для рутинных задач обслуживания системы

Требования

  • наличие высшего образования
  • опыт администрирования Linux-систем от 1 года, уверенная работа с командной строкой, понимание процессов, файловой структуры и сетевого стека TCP/IP
  • базовый практический опыт работы с Docker и оркестратором Kubernetes (понимание принципов Pod, Service, Ingress, ConfigMap)
  • знакомство с системами контроля версий (Git) и CI/CD инструментами
  • понимание принципов работы реляционных (PostgreSQL) и нереляционных (MongoDB, Redis) баз данных на уровне написания простых запросов и проверки доступности
  • навык чтения кода на Python для разбора существующих скриптов автоматизации
  • опыт применения LLM в работе: использование нейросетей как инструмента для ускорения рабочих задач (генерация bash/python скриптов, помощь в разборе сложных ошибок в логах, написание документации)
  • готовность к участию в дежурствах второй линии поддержки (3–4 раза в месяц) и обучению культуре Incident Response

будет преимуществом:

  • минимальный опыт настройки мониторинга метрик в Prometheus и визуализации в Grafana
  • опыт запуска сборок в GitLab или Jenkins

Условия

  • гибридный формат в Москве (Кутузовский пр, 32)
  • ежегодный пересмотр зарплаты и годовая премия
  • расширенный ДМС и льготное страхование для семьи
  • уникальная система обучения Сбера для профессионального и карьерного развития
  • выгодная ипотека для сотрудников
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера
  • корпоративная пенсионная программа.
Посмотреть контакты работодателя

Похожие вакансии

СБЕР
  • Москва

  • Не указана

Рекомендуем
СБЕР
  • Москва

  • Не указана

Рекомендуем
  • Москва

  • Не указана

Рекомендуем
СБЕР
  • Москва

  • Не указана

ДенизБанк Москва
  • Москва

  • Не указана

СберЛизинг

Devops-инженер

СберЛизинг

  • Москва

  • Не указана

Holyweb
  • Москва

  • Не указана

Ок Софт

SRE engineer

Ок Софт

  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

Группа компаний Астра
  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

РТК-ЦОД

DevOps-инженер

РТК-ЦОД

  • Москва

  • Не указана

СБЕР
  • Москва

  • до 150000 RUR

СБЕР
  • Москва

  • до 150000 RUR

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию