Senior DevOps engineer / SRE engineer (highload)

RWB (Wildberries & Russ)

Senior DevOps engineer / SRE engineer (highload)

Описание вакансии

Вам предстоит:

  • Проектировать и реализовывать архитектуру инфраструктуры продукта: обеспечивать высокую доступность (HA), отказоустойчивость по зонам, проводить capacity planning;
  • Разбирать сложные кросс-системные инциденты на стыке Kubernetes, баз данных, сетей и приложений. Доводить их до root cause, фиксировать результаты в постмортемах;
  • Развивать IaC: поддерживать Ansible-инвентарь для provisioning VM и конфигурации кластеров БД/брокеров, автоматизировать ручные процессы эксплуатации;
  • Эксплуатировать и развивать кластеры данных: PostgreSQL/Patroni (включая шардирование), Kafka, Redis Cluster, OpenSearch, MongoDB. Участвовать в R&D миграции хранилища сообщений на ScyllaDB;
  • Развивать CI/CD-процесс совместно с инженером CI: внедрять trunk-based development, автопромоушен, стратегии canary- и blue-green-релизов;
  • Строить мониторинг и модели здоровья системы: определять ключевые метрики, настраивать алертинг и SLO-пробы.
Вы нам подходите, если:
  • Имеете 5+ лет опыта эксплуатации highload-продакшена в роли SRE, DevOps или инфраструктурного инженера;
  • Глубоко траблшутите Kubernetes в проде: понимаете сеть, ingress, распределение ресурсов и отказоустойчивость (не ограничиваетесь только деплоем), уверенно работаете с Helm;
  • Уверенно эксплуатируете базы данных: обязательно PostgreSQL (репликация, failover/Patroni, бэкапы, восстановление, тюнинг производительности) плюс минимум одну из систем: Kafka, Redis Cluster, OpenSearch/Elasticsearch, Cassandra/ScyllaDB;
  • Владеете IaC на уровне Ansible (роли, инвентари) или готовы перейти на него; глубоко знаете Linux-администрирование (systemd, сеть, дисковая подсистема);
  • Настраиваете CI/CD: имеете опыт с GitLab CI или аналогами, понимаете trunk-based development и progressive delivery (canary-релизы);
  • Строите наблюдаемость «от модели здоровья»: владеете Prometheus/PromQL, настраиваете алертинг и трейсинг, умеете проектировать мониторинг под бизнес-логику сервиса, а не просто собирать готовые дашборды;
  • Управляете инцидентами: несете on-call, приоритизируете задачи во время сбоев и пишете качественные постмортемы;
  • Обладаете самостоятельностью: способны взять направление целиком и вести его без микроменеджмента.
Навыки
  • Python
  • Terraform
  • Kafka
  • Golang
  • k8s
  • ELK
  • AWS
  • Spring Cloud
  • Yandex Cloud
  • Redis
  • PostgreSQL
Посмотреть контакты работодателя

Похожие вакансии

Гознак

Senior DevOps Engineer

Гознак

  • Москва

  • Не указана

Рекомендуем
Яндекс
  • Москва

  • Не указана

Рекомендуем
DatsTeam
  • Москва

  • Не указана

Рекомендуем
  • Москва

  • Не указана

Americor Funding Inc

DevOps

Americor Funding Inc

  • Москва

  • Не указана

Drivee
  • Москва

  • Не указана

  • Москва

  • Не указана

Build-инженер (ГигаЧат Бизнес)

Салют для Бизнеса

  • Москва

  • Не указана

ScanFactory

Senior SRE Engineer

ScanFactory

  • Москва

  • Не указана

ГКУ Инфогород

Senior DevOps engineer

ГКУ Инфогород

  • Москва

  • Не указана

Senior DevOps

Лектон

  • Москва

  • Не указана

Leads
  • Москва

  • до 350000 RUR

Юрент

Team Lead DevOps

Юрент

  • Москва

  • до 350000 RUR

YADRO
  • Москва

  • до 350000 RUR

МФК Фордевинд

Technical Lead (Lead DevOps)

МФК Фордевинд

  • Москва

  • до 350000 RUR

LIFE PAY

Senior DevOps

LIFE PAY

  • Москва

  • до 350000 RUR

Фалькон Тех

Senior DevOps инженер

Фалькон Тех

  • Москва

  • до 350000 RUR

HeadHunter
  • Москва

  • до 350000 RUR

2ГИС
  • Москва

  • до 350000 RUR

Swordfish Security
  • Москва

  • до 350000 RUR

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию