Senior Big Data Engineer (Data Platform)

Lamoda Tech

Senior Big Data Engineer (Data Platform)

Москва, Крылатская улица, 15

Метро: Крылатское

Описание вакансии

Чем предстоит заниматься:

  • Разрабатывать и совершенствовать лучшую на рынке платформу данных электронной коммерции нового поколения;
  • Проектировать и разрабатывать ETL пайплайны на Airflow для Spark (Batch, Streaming), Iceberg, Trino;
  • Оптимизировать действующие пайплайны и джобы на Spark - мониторить нагрузку на кластер и оптимальность затрачиваемых джобами ресурсов и если необходимо оптимизировать;
  • Взаимодействовать с аналитиками и ML специалистами для создания/развертывания инструментов и наборов данных, соответствующих их вариантам использования - поддерживать регулярные связи с data ops для развития дата-платформы;
  • Анализировать и внедрять инструменты инжиниринга данных (Lineage, DQ);
  • Проектировать хранилища данных на основе k8s, настраивать производительность, мониторинг, планировать емкости кластера и другой инфраструктуры - думать над тем что и как грузить и в каких партициях;
  • Решать задачи, связанные с внедрением облачной инфраструктуры - разрабатывать новую архитектуру хранилища
  • Проводить code review и принимать участие в архитектурных решениях по дата платформе в команде.

Мы ожидаем:

  • Kubernetes - понимание ресурсной модели, просмотр конфигураций, troubleshooting.
  • Опыт работы с Hadoop (HDFS, Hive Metastore)
  • Опыт работы со Spark (spark SQL, streaming, понимание ньюансов работы с pyspark);
  • Apache Icberg – владение процедурами, snapshots, maintenance
  • Глубокое понимание Airflow (2, 3) – идемпотентность, assets, backfills
  • Уверенное знание Git, CI/CD;
  • Python, Scala/Java – ООП, проектирование библиотек, интеграционные/юнит тесты;
  • Хорошее понимание СУБД, SQL;

Будет плюсом:

  • Опыт работы с Docker (уверенное владение для поднятия локального окружения проекта);
  • Опыт работы с Kafka – понимание архитектуры и слабых мест;
  • Опыт с облачными технологиями: преимущественно Yandex Cloud;
  • Опыт с Clickhouse.
  • AI-native подход к разработке: активное использование Claude Code / Codex и подобных инструментов, опыт построения harness-систем — агентов с инструментами, автоматизации через LLM, RAG.
Навыки
  • Kubernetes
  • Hadoop
  • Spark
  • icberg
  • airflow
  • Python
  • Scala
  • Java
  • SQL
Посмотреть контакты работодателя

Адрес

Похожие вакансии

Детский мир

Data Engineer (Hadoop / Spark)

Детский мир

  • Москва

  • Не указана

Рекомендуем
ИЦ АЙ-ТЕКО

Data Engineer

ИЦ АЙ-ТЕКО

  • Москва

  • Не указана

Рекомендуем
ТЕХНОНИКОЛЬ

Data Engineer

ТЕХНОНИКОЛЬ

  • Москва

  • Не указана

Рекомендуем
Полицифра

Data Engineer

Полицифра

  • Москва

  • Не указана

RUTUBE

Data Engineer

RUTUBE

  • Москва

  • Не указана

Флаувау

Senior Data Engineer

Флаувау

  • Москва

  • Не указана

Домклик
  • Москва

  • Не указана

Профи.ру
  • Москва

  • Не указана

ГНИВЦ
  • Москва

  • Не указана

Digital Chief
  • Москва

  • Не указана

АНО ЦИСМ

Инженер данных

АНО ЦИСМ

  • Москва

  • Не указана

МФК ВЭББАНКИР

Tech Lead MLOps

МФК ВЭББАНКИР

  • Москва

  • Не указана

Мокка
  • Москва

  • Не указана

СберЗдоровье

Senior ML Engineer (NLP)

СберЗдоровье

  • Москва

  • Не указана

ИК СИБИНТЕК

Data Scientist/ML инженер

ИК СИБИНТЕК

  • Москва

  • Не указана

RWB (Wildberries & Russ)
  • Москва

  • Не указана

РУСАЛ
  • Москва

  • Не указана

Ozon
  • Москва

  • Не указана

Ozon
  • Москва

  • Не указана

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию