SRE-инженер

Сбер2B

SRE-инженер

Москва, улица Обручева, 30/1с2

Метро: Воронцовская

Описание вакансии

Сбер2В — система бизнес-сервисов под единым управлением. Вместе мы решаем комплексные задачи государства, бизнеса и регионов с помощью аналитики больших данных, искусственного интеллекта, автоматизации и ЭДО.

Мы в цифрах:
• 50+ собственных решений
• 1,2 млн клиентов малого бизнеса
• 40+ отраслей используют наши продукты
• 2,5 тыс. клиентов крупного бизнеса и госсектора

Наши технологии (аналитика больших данных, машинное обучения, визуализация) помогают бизнесу расти, а регионам — развиваться.

Сейчас мы находимся в поисках Ведущего инженера SRE в наше Управление продуктовой стабильности и релизов. Команда обеспечивает сквозные процессы поддержки продуктов холдинга из 8 дочерне зависимых обществ:

- Инцидент-менеджмент — управление инцидентами, координация реагирования, восстановление стабильности продуктов

- Управление надёжностью продуктов — обеспечение и повышение надёжности (SLO/SLI, бюджеты ошибок, мониторинг)

- Поставка ценности на стенды — обеспечение процессов CI/CD, развёртывание релизов

- Управление изменениями — контроль и сопровождение изменений в промышленной среде

Новому участнику нашей ИТ-команды предстоит плечом к плечу работать с командами продуктов Сбер2В, обеспечивая эксплуатационную готовность и стабильность сервисов.

Чем предстоит заниматься:

  • Координировать инциденты P0/P1, включая формирование рабочей группы при их возникновении, распределение задач, диагностику, принятие решений об откате и деградации, разбор без поиска виновных
  • Управлять проблемами: проводить анализ первопричин, формировать программы мероприятий и осуществлять контроль их исполнения
  • Управлять изменениями: проводить оценку рисков, авторизацию изменений в промышленную среду, участвовать в CAB
  • Проектировать мониторинг и наблюдаемость: метрики, логи, трейсы, многоуровневые SLO/SLI, аудит качества
  • Проектировать архитектуры надёжности: отказоустойчивость, multi-AZ, деградация, ограничители нагрузки
  • Сопровождать релизы и приёмку сервисов в эксплуатацию (ПСИ)
  • Планировать ёмкость, проводить хаос-эксперименты и тестирование аварийного восстановления (DRT)
  • Формировать стандарты SRE для направления, заниматься наставничеством младших инженеров

Мы будем рады познакомиться, если у тебя есть:

  • Опыт работы в ИТ от 5ти лет, в эксплуатации или SRE от 3х лет
  • Опыт ведения инцидентов P2/P1 и проектирования мониторинга, SLO, инструкций реагирования
  • Технические знания и опыт работы с: Linux, Kubernetes / OpenShift, Prometheus, Grafana, ELK, Loki (и аналоги)
  • Знания и опыт работы с сетями: TCP/IP, DNS, HTTP/HTTPS, балансировка, ingress-контроллеры, сервис-меш
  • Стремление автоматизировать свою работу: уверенно писать скрипты на Bash, применять Python на уровне инженерных автоматизаций
  • Понимание архитектуры надёжности: отказоустойчивость, multi-AZ, деградация, ограничители нагрузки, идемпотентность
  • Опыт ведения инцидентного процесса P0/P1 в роли координатора, с управлением боевыми комнатами, разбором и эскалациями
  • Опыт работы с базами данных, включая репликацию, шардирование, резервное копирование и диагностику производительности
  • Умение выстраивать конструктивную коммуникацию с разработкой, DevOps и инфраструктурой

Будет преимуществом/плюсом:

  • Опыт работы в холдинговой структуре с несколькими компаниями
  • Опыт миграций между ЦОД, облачными провайдерами, кластерами
  • Опыт внедрения SLO/бюджета ошибок в продуктах
  • Опыт участия в CAB
  • Опыт работы с ITSM-системами класса Naumen, Jira ServiceDesk

Что мы предлагаем:

  • Работу в аккредитованной IT-компании
  • Удобный офис (м. Калужская, ул. Обручева 30/1 с.2)
  • Ежегодный бонус по итогам работы
  • Подключение к ДМС, телемедицина, чек-ап – после прохождения испытательного срока
  • Ведение беременности и родов, лазерная коррекция зрения и стоматология после 2х лет непрерывного стажа в группе Сбер
  • Специальные условия для страхования семьи
  • Возможность участия в корпоративной пенсионной программе
  • Корпоративное обучение
  • Бесплатную подписку на СберПрайм и скидки у партнёров
  • Новогодние подарки для детей, корпоративные мероприятия и поддержку в особых жизненных ситуациях
  • Скидки в спортклубы X-Fit, WorldClass

Почему у нас классно работать:

  • Видимый результат: твой вклад напрямую влияет на продукт и развитие компании
  • Минимизируем бюрократию, даем возможность проявлять инициативу
  • Есть возможность карьерного роста внутри команды или других подразделений
  • Вклад в развитие общества: наши исследования способствуют улучшению экономики регионов и качества жизни людей

Мы верим в силу данных как инструмента позитивных изменений.

Навыки
  • SRE
  • Kubernetes
  • OpenShift
  • Bash
  • Python
  • Linux
  • Prometheus
  • Grafana
  • ELK
  • Инцидент-менеджмент
Посмотреть контакты работодателя

Адрес

Похожие вакансии

BI.ZONE
  • Москва

  • Не указана

Рекомендуем
  • Москва

  • Не указана

Рекомендуем
ГКУ Центр организации дорожного движения Правительства Москвы

SRE-инженер

ГКУ Центр организации дорожного движения Правительства Москвы

  • Москва

  • Не указана

Рекомендуем
СБЕР
  • Москва

  • Не указана

СБЕР

SRE engineer

СБЕР

  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

НПП Баум

SRE-инженер

НПП Баум

  • Москва

  • Не указана

Криптонит

SRE-инженер (ЦОД)

Криптонит

  • Москва

  • Не указана

Rambler&Co

SRE-инженер

Rambler&Co

  • Москва

  • Не указана

SberTech
  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

СБЕР
  • Москва

  • Не указана

«UZUM TECHNOLOGIES»

Senior SRE-Инженер

«UZUM TECHNOLOGIES»

  • Москва

  • Не указана

Финфрейм
  • Москва

  • Не указана

Страховая компания Сбербанк страхование

Devops\SRE инженер

Страховая компания Сбербанк страхование

  • Москва

  • Не указана

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию