Основная задача - развивать надёжную и безопасную инженерную платформу для банковских продуктов.
Обязанности:
Проектирование, автоматизация и сопровождение отказоустойчивой инфраструктуры банковских продуктов, включая среды, CI/CD, Infrastructure as Code, наблюдаемость, безопасность, резервирование и восстановление.
Создание self-service инструментов, позволяющих разработчикам самостоятельно собирать, тестировать, развёртывать и диагностировать сервисы в пределах согласованных ограничений.
Обеспечение производительности и масштабируемости платформы, участие в нагрузочном тестировании и устранении инфраструктурных узких мест.
Развитие метрик, логов, трассировки и оповещений; участие в разборе инцидентов и устранении их системных причин.
Автоматизация управления конфигурациями, секретами, доступами и требованиями безопасности.
Поддержание эксплуатационной документации и проверенных процедур развёртывания, отката и восстановления.
Требования:
Опыт построения и промышленной эксплуатации инфраструктуры высоконагруженных систем с высокими требованиями к доступности и восстановлению после сбоев.
Практический опыт построения CI/CD и автоматизации полного цикла поставки изменений.
Опыт контейнеризации и оркестрации приложений, включая Docker и Kubernetes или сопоставимые технологии.
Опыт управления инфраструктурой и конфигурациями с использованием Infrastructure as Code (IaC);
Опыт построения наблюдаемости: метрики, централизованные логи, распределённая трассировка, dashboards и alerts.
Понимание отказоустойчивости, резервного копирования, disaster recovery и принципов эксплуатации критичных сервисов.
Опыт безопасного управления секретами, сервисными учётными записями и доступами.
Навыки автоматизации на Bash, Python или другом скриптовом языке.
Опыт AI-assisted работы: использование coding agents для подготовки и анализа IaC, pipeline-конфигураций, скриптов, диагностики и документации с обязательной инженерной проверкой результата.
Опыт эксплуатации банковских, платёжных или других регулируемых систем.
Опыт работы с высоконагруженными Java-сервисами и диагностики JVM.
Опыт эксплуатации Kafka, PostgreSQL, Redis и других компонентов распределённых систем.
Практика формализации SLI/SLO, error budgets и capacity planning.
Опыт нагрузочного тестирования и анализа производительности всей цепочки от приложения до инфраструктуры.
Опыт построения платформы для on-premise, cloud или гибридной инфраструктуры.
Практический опыт реагирования на инциденты, организации дежурств и проведения postmortem.
Будет преимуществом :
Опыт эксплуатации банковских, платёжных или других регулируемых систем, работы с высоконагруженными Java-сервисами и диагностики JVM, эксплуатации Kafka, PostgreSQL, Redis и других компонентов распределённых систем.
Практика формализации SLI/SLO, error budgets и capacity planning.
Опыт нагрузочного тестирования и анализа производительности всей цепочки от приложения до инфраструктуры.
Опыт построения платформы для on-premise, cloud или гибридной инфраструктуры.
Практический опыт реагирования на инциденты, организации дежурств и проведения postmortem.
Мы предлагаем:
Официальное трудоустройство.
Уровень вознаграждения обсуждается с успешным кандидатом