Data Engineer (Hadoop, Scala)

Медиалогия

Data Engineer (Hadoop, Scala)

Москва, Новодмитровская улица, 2к2

Метро: Дмитровская

Описание вакансии

Медиалогия занимается разработкой продуктов по сбору и анализу данных из СМИ и соцмедиа.

Мы разрабатываем высоконагруженные системы, которые в режиме реального времени сканируют весь текстовый сегмент Интернета (100+ млн. сообщений в сутки, 1.7 млрд. метрик) и, используя уникальные лингвистические технологии, позволяют осуществлять мгновенный анализ упоминаний наших клиентов в социальных сетях, блогах, форумах и управлять их репутацией.

Обязанности:

  • разработка и оптимизация ETL/ELT-конвейеров для обработки больших данных;
  • настройка и администрирование Hadoop/Spark-инфраструктуры (HDFS, YARN, Hive, HBase);
  • оптимизация распределенных вычислений и запросов;
  • работа с потоковыми данными (Kafka, Spark Streaming, RabbitMQ);
  • участие в проектировании и масштабировании архитектуры данных;
  • автоматизация процессов с использованием DevOps-практик (Docker, CI/CD).

Требования:

  • высшее (неоконченное высшее) образование;
  • опыт работы с Java/Scala и Big Data-фреймворками (Apache Spark, Hadoop);
  • глубокие знания Hadoop-экосистемы (YARN, HDFS, Hive, HBase, Parquet);
  • опыт оптимизации производительности распределенных систем;
  • работа с потоковой обработкой (Kafka, Spark Streaming);
  • навыки работы с SQL/NoSQL (PostgreSQL, MS SQL, MongoDB).

Будет плюсом:

  • опыт с PySpark, Flink, Airflow;
  • знание Elasticsearch, ClickHouse, Vertica;
  • навыки настройки кластеров и инфраструктуры.

Условия:

  • удаленный или гибридный формат работы;
  • заработная плата обсуждается по итогам собеседования с успешным кандидатом;
  • ДМС после испытательного срока;
  • специальные условия для сотрудников на страхование для членов семьи;
  • скидки в компаниях-партнерах (фитнес-центры, обучающие курсы, изучение иностранных языков и многое другое);
  • бесплатное онлайн-обучение на корпоративном портале и корпоративная библиотека;
  • участие в сложных Big Data-проектах с высокой нагрузкой;
  • офис в пешей доступности от ст. м. Дмитровская (БЦ «Савеловский Сити»).
Навыки
  • Scala
  • Hadoop
  • SQL
  • Apache Kafka
Посмотреть контакты работодателя

Адрес

Похожие вакансии

RWB (Wildberries & Russ)

Data Engineer (Прайсинг)

RWB (Wildberries & Russ)

  • Москва

  • Не указана

Рекомендуем
ТЕХНОНИКОЛЬ

Data Engineer

ТЕХНОНИКОЛЬ

  • Москва

  • Не указана

Рекомендуем
Playerok
  • Москва

  • от 230000 RUR

Рекомендуем
Нетбелл
  • Москва

  • от 230000 RUR

ГКУ Инфогород

Data Engineer

ГКУ Инфогород

  • Москва

  • от 230000 RUR

АНО ЦИСМ

Инженер данных

АНО ЦИСМ

  • Москва

  • от 230000 RUR

Домклик
  • Москва

  • от 230000 RUR

Компания БКС

Data Engineer

Компания БКС

  • Москва

  • от 230000 RUR

Медиалогия

Data Quality Engineer

Медиалогия

  • Москва

  • от 230000 RUR

2ГИС
  • Москва

  • от 230000 RUR

SkillStaff
  • Москва

  • от 230000 RUR

USETECH
  • Москва

  • от 230000 RUR

evrone.ru
  • Москва

  • от 230000 RUR

Мокка
  • Москва

  • от 230000 RUR

ON Медиа
  • Москва

  • от 230000 RUR

Secunda
  • Москва

  • от 230000 RUR

«UZUM TECHNOLOGIES»

Senior Data Engineer

«UZUM TECHNOLOGIES»

  • Москва

  • от 230000 RUR

СберМедИИ

Data Scientist LLM (Middle)

СберМедИИ

  • Москва

  • от 230000 RUR

Домклик
  • Москва

  • от 230000 RUR

Лига Цифровой Экономики

Аналитик данных / Data Governance & Data Quality

Лига Цифровой Экономики

  • Москва

  • от 230000 RUR

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию