Мы создаем и развиваем корпоративный движок потоковой обработки данных на основе Apache Flink, который используется разработчиками банка для построения приложений реального времени: фрод-мониторинг, скоринг, обогащение транзакций, расчеты. Вы будете работать в платформенной команде, которая отвечает за фреймворк и платформенные возможности Flink.
Платформа находится в фазе активного развития: в рамках стратегического проекта мы снижаем сквозную задержку поставки данных с часов до секунд, развиваем stateful-обработку на внешних state backends, строим self-service управление жизненным циклом приложений и готовим платформу к сценариям реального времени для AI-агентов. Аналитик в этой команде — ключевая роль на стыке архитектуры, разработки и потребителей: от качества проработки требований напрямую зависит скорость и надежность развития платформы.
Обязанности:
- анализ, проработка ТЗ и приемка реализации механизмов stateful-обработки с использованием внешних state backends (S3-совместимое объектное хранилище, HBase, перспективно — Fluss) для сценариев соединения с большими справочниками и хранения состояния приложений
- проектирование решений для повышения отказоустойчивости и управляемости приложений: savepoints, автоскейлинг, восстановление после сбоев
- разработка требований к интеграции Flink-приложений с корпоративными системами: аутентификация, секрет-менеджеры, логирование (ELK), метрики (Prometheus/Grafana)
- проработка требований к системе мониторинга состояния Flink-кластеров и джобов: метрики JVM, backpressure, checkpoint durations, lag
- анализ и проектирование процесса управления жизненным циклом приложений (деплой, апгрейд, остановка) через корпоративный портал управления сервисами
- проектирование интеграции Flink JobManager / REST API с порталом управления
- выявление и формализация потребностей внутренних команд-разработчиков
- Создание подробной технической документации, чек-листов и best practices для команд-потребителей
- Тестирование реализованных функций: разработка тест-планов и сценариев (включая негативные и нагрузочные), проведение приемо-сдаточных испытаний.
Требования
- опыт работы системным или бизнес-аналитиком от 4 лет, из них не менее 2 лет в области потоковой обработки данных или Big Data
- опыт проектирования и описания интеграций через REST API
- знание принципов работы систем мониторинга (Prometheus, Grafana), умение читать и интерпретировать метрики
- продвинутый уровень SQL, умение работать с технической документацией (RFC, официальная документация)
- навыки декомпозиции сложных задач и построения процессов; отличные коммуникационные навыки для работы с техническими командами (разработчики, DevOps) и потребителями (data-инженеры)
- умение четко и структурно документировать требования в виде ТЗ / User Stories с критериями приемки.
Будет плюсом:
- глубокое понимание архитектуры Apache Flink: концепции операторов, state, checkpointing, savepoints, exactly-once семантика, роль JobManager/TaskManager
- практический опыт проектирования или эксплуатации Flink-приложений; понимание проблематики хранения и восстановления состояния
- знание экосистемы Hadoop / Big Data: HDFS, HBase, Kafka; понимание принципов работы с объектными хранилищами (S3)
- опыт работы с Kubernetes: понимание основных концептов (Pods, Deployments, Services, ConfigMaps).
Мы предлагаем:
- комфортный современный офис в Москве: БЦ Даниловский форт, рядом с М.Тульская, Верхние котлы
- возможность выбрать удобный график – офис/гибрид
- ежегодный пересмотр зарплаты, годовая премия
- корпоративный спортзал и зоны отдыха
- более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
- расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
- гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
- подписка Прайм с возможностью совместного использования на трёх близких
- вознаграждение за рекомендацию друзей в команду Сбера.