DevOps / Platform Engineer

DevOps / Platform Engineer

Санкт-Петербург

Метро: Адмиралтейская

Описание вакансии

DevOps / Platform Engineer

Мы ищем DevOps / Platform Engineer для развития и эксплуатации внутренней микросервисной платформы.

Нам нужен инженер, который сможет не только поддерживать инфраструктуру в рабочем состоянии, но и развивать её как единую платформу для продуктовых команд: стандартизировать запуск сервисов, автоматизировать deployment, поддерживать Kubernetes и общие инфраструктурные сервисы, observability, identity/security-инфраструктуру и локальное окружение разработчиков.

Чем предстоит заниматься

Основная зона ответственности — эксплуатация и развитие платформы, на которой работают микросервисы компании.

В задачи будут входить:

  • эксплуатация и развитие Kubernetes-кластеров;
  • сопровождение PostgreSQL, Kafka, Redis и других shared platform resources;
  • эксплуатация Keycloak и инфраструктуры аутентификации сервисов;
  • сопровождение API Gateway и service registration/discovery;
  • развитие CI/CD для микросервисов;
  • создание и поддержка Helm charts;
  • Docker/container runtime;
  • управление конфигурацией и secrets;
  • поддержка dev/stage/prod окружений;
  • развитие локального platform runtime для разработчиков;
  • организация централизованных logs, metrics и traces;
  • Prometheus/Grafana и развитие alerting;
  • OpenTelemetry;
  • readiness/liveness/startup probes;
  • управление ресурсами Kubernetes, requests/limits и HPA;
  • анализ производительности и capacity planning;
  • backup/restore и disaster recovery;
  • обновление платформенных компонентов;
  • управление сертификатами, ingress, DNS и сетевой инфраструктурой;
  • поиск причин инфраструктурных и production-инцидентов;
  • участие в разборе инцидентов и устранении их системных причин;
  • поддержание инфраструктуры воспроизводимой через IaC;
  • автоматизация рутинных эксплуатационных операций.

Отдельная важная часть работы — Platform Engineering. Мы хотим, чтобы новый микросервис подключался к платформе по стандартизированному пути, а не собирал собственную инфраструктуру вокруг себя.

Например, разработчику сервиса не должно требоваться самостоятельно придумывать, как подключить Kafka, зарегистрировать сервис, настроить observability или подготовить Kubernetes deployment. Платформа должна предоставлять для этого готовые контракты, шаблоны и автоматизацию.

С чем предстоит работать

Наш технологический стек включает:

Platform / Infrastructure: Kubernetes, Docker, Helm, Linux, Nginx/API Gateway, DNS/TLS.

Data & Messaging: PostgreSQL, Kafka, Schema Registry, Redis, Cassandra, Clickhouse

Identity & Security: Keycloak, OAuth 2.0 / OpenID Connect, JWT, service-to-service authentication.

Observability: Prometheus, Grafana, OpenTelemetry, централизованные structured logs, distributed tracing, Loki

Development: микросервисная архитектура, преимущественно JVM/Kotlin/Spring Boot сервисы; REST, GraphQL, gRPC, Kafka/Avro.

Delivery: Git, CI/CD, container registry, автоматизированные сборки, тестирование и deployment.

Что для нас важно

Мы ожидаем уверенный production-опыт с Kubernetes и Linux и хорошее понимание того, как устроена работающая микросервисная платформа целиком, а не только отдельных CI pipelines.

Нужен опыт с Kubernetes, Docker, Helm, CI/CD, PostgreSQL и Kafka, понимание networking, DNS, TLS, ingress и reverse proxy, а также практический опыт построения monitoring/alerting.

Важно понимать:

  • readiness/liveness/startup semantics;
  • rolling deployment и zero/low-downtime deployment;
  • resource requests/limits;
  • autoscaling;
  • secrets management;
  • RBAC;
  • backup/restore;
  • Kafka topics, consumer groups и Schema Registry;
  • database migrations;
  • OAuth/OIDC и service-to-service authentication;
  • troubleshooting распределённых систем.

Мы ожидаем способность разобраться в проблеме уровня:

«Сервис успешно запустился, но не получает Kafka events, readiness нестабилен, traces отсутствуют, а после deployment часть запросов через Gateway получает 502»

— и последовательно найти причину на уровне приложения, Kubernetes, сети, Kafka или платформенной конфигурации.

Будет большим плюсом

Опыт именно в Platform Engineering , а также GitOps, Argo CD/Flux, Terraform/OpenTofu, Ansible, Vault или аналогичных secrets-management системах.

Плюсом будет опыт эксплуатации Kafka в production, Keycloak, OpenTelemetry, gRPC/GraphQL и JVM/Spring Boot приложений.

Особенно интересен опыт создания Golden Path для разработчиков: когда новый сервис получает стандартные Helm templates, CI/CD, observability, security, service registration и доступ к shared resources практически из коробки.

Что мы хотим получить от этой роли

Нам не нужен человек, который будет вручную «чинить серверы».

Цель роли — постепенно добиться состояния, при котором инфраструктура и эксплуатация становятся предсказуемой платформой.

У нового микросервиса должен существовать стандартный жизненный цикл:

repository → build → tests → image → registry → deploy → registration → gateway → observability → alerts

При этом PostgreSQL, Kafka, Redis, Keycloak и другие общие компоненты должны оставаться платформенными ресурсами с понятными правилами подключения и изоляции.

Первые задачи

В первые месяцы мы хотим вместе провести аудит существующей инфраструктуры и зафиксировать её фактическое состояние, после чего:

  1. привести Kubernetes/runtime к воспроизводимой конфигурации;
  2. формализовать dev/stage/prod environments;
  3. привести CI/CD к единому стандарту;
  4. стандартизировать Helm/deployment сервисов;
  5. привести в порядок monitoring, alerting, logging и tracing;
  6. формализовать эксплуатацию PostgreSQL/Kafka/Redis/Keycloak;
  7. настроить backup/restore и проверить восстановление;
  8. сформировать Golden Path для нового микросервиса;
  9. уменьшить количество ручных действий при deployment;
  10. определить SLI/SLO для критичных компонентов платформы.
  11. Раскатать инфраструктуру на AWS

Навыки
  • Kubernetes
  • DevOps
  • Kafka
  • Docker
  • Linux
Посмотреть контакты работодателя

Адрес

Похожие вакансии

Инситех

DevOps-инженер

Инситех

  • Санкт-Петербург

  • Не указана

Рекомендуем
Нанософт

Senior DevOps Engineer

Нанософт

  • Санкт-Петербург

  • Не указана

Рекомендуем
Инситех
  • Санкт-Петербург

  • Не указана

ЦРТ | Группа компаний
  • Санкт-Петербург

  • Не указана

Axenix (ранее Accenture)

Junior+ QA Automation Engineer (Python)

Axenix (ранее Accenture)

  • Санкт-Петербург

  • Не указана

СОЛВО
  • Санкт-Петербург

  • Не указана

  • Санкт-Петербург

  • Не указана

UserGate
  • Санкт-Петербург

  • Не указана

Инфосистемы Джет

Инженер

Инфосистемы Джет

  • Санкт-Петербург

  • до 300000 RUR

Paragon Software

Technical Support Engineer

Paragon Software

  • Санкт-Петербург

  • до 300000 RUR

БИОКАД, биотехнологическая компания
  • Санкт-Петербург

  • до 300000 RUR

DevOps-инженер

Орион Технологии

  • Санкт-Петербург

  • до 300000 RUR

Диплей
  • Санкт-Петербург

  • до 300000 RUR

Экспертные Решения
  • Санкт-Петербург

  • от 150000 RUR

Суточно.ру
  • Санкт-Петербург

  • от 150000 RUR

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию