Data Engineer (Прайсинг)

RWB (Wildberries & Russ)

Data Engineer (Прайсинг)

Москва

Метро: Библиотека им.Ленина

Описание вакансии

Объединённая компания Wildberries и Russ — это международная технологическая компания, образованная в результате слияния двух лидеров рынка — IT-компании Wildberries и оператора наружной рекламы Russ.

Прайсинг — строит и развивает аналитическое хранилище продукта "Платформа Ценообразования". В зоне ответственности команды 4 продукта разной направленности: аналитика, бекенд, ML.

Вам предстоит:

  • Проектировать и разрабатывать пайплайны загрузки данных. Делать это оптимально в зависимости от потребностей команд потребителей;
  • Проектировать загрузку данных, раскладку по слоям, витрины в ClickHouse: выбор движка таблиц, ключей сортировки и партиционирования, ключей шардирования и репликации;
  • Оптимизировать запросы и хранение: разбираться, почему запрос медленный или таблица растёт быстрее ожидаемого, и чинить это;
  • Разрабатывать и поддерживать DAGи в Airflow: идемпотентность, ретраи, бэкфиллы, зависимости между задачами;
  • Обеспечивать качество данных: проверки по полноте и консистентности, сверки между системами, алертинг и мониторинг пайплайнов;
  • Работать напрямую с продуктовыми командами и аналитиками: разбирать требования, договариваться о контрактах данных, объяснять ограничения и предлагать варианты.

Вы нам подходите, если:

  • Имеете опыт работы с ClickHouse (это ключевой навык для данной позиции. Необходимо уметь идентифицировать проблемы на кластере, понимать как работать с распределенной БД, как оптимально собрать пайплайны, чтобы не убить кластер);
  • уверенно работаете с SQL, а именно с большими объёмами (у нас есть таблицы 50+ Tb);
  • владеете Python для разработки пайплайнов, а иногда даже бекенда на FastAPI;
  • имеете опыт работы с Apache Airflow (опыт разработки и эксплуатации DAGов в проде, понимание идемпотентности и бэкфиллов);​​​​​​​
  • имеете опыт работы с Apache Kafka (понимание модели (топики, партиции, консьюмер-группы, оффсеты, семантика доставки), опыт построения загрузки из Kafka в хранилище)
  • имеете опыт интеграции данных из REST API и реляционных БД (PostgreSQL и аналоги), включая инкрементальную загрузку и работу с изменениями данных.
Посмотреть контакты работодателя

Адрес

Похожие вакансии

Домклик
  • Москва

  • Не указана

Рекомендуем
Медиалогия

Data Quality Engineer

Медиалогия

  • Москва

  • Не указана

Рекомендуем
Медиалогия

Data Engineer (Hadoop, Scala)

Медиалогия

  • Москва

  • Не указана

Рекомендуем
ТЕХНОНИКОЛЬ

Data Engineer

ТЕХНОНИКОЛЬ

  • Москва

  • Не указана

SkillStaff
  • Москва

  • Не указана

АНО ЦИСМ

Инженер данных

АНО ЦИСМ

  • Москва

  • Не указана

Нетбелл
  • Москва

  • Не указана

Playerok
  • Москва

  • от 230000 RUR

Домклик
  • Москва

  • от 230000 RUR

Домклик
  • Москва

  • от 230000 RUR

evrone.ru
  • Москва

  • от 230000 RUR

Компания БКС

Data Engineer

Компания БКС

  • Москва

  • от 230000 RUR

ГКУ Инфогород

Data Engineer

ГКУ Инфогород

  • Москва

  • от 230000 RUR

Мокка
  • Москва

  • от 230000 RUR

Негосударственный Пенсионный Фонд Сбербанка

Data Engineer / ETL-разработчик

Негосударственный Пенсионный Фонд Сбербанка

  • Москва

  • от 230000 RUR

ON Медиа
  • Москва

  • от 230000 RUR

«UZUM TECHNOLOGIES»

Senior Data Engineer

«UZUM TECHNOLOGIES»

  • Москва

  • от 230000 RUR

Страховая компания Сбербанк страхование

Data Engineer в команду Страхового потенциала B2B

Страховая компания Сбербанк страхование

  • Москва

  • от 230000 RUR

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию