DataOps

Медиалогия

DataOps

Москва, Новодмитровская улица, 2к2

Метро: Дмитровская

Описание вакансии

Медиалогия занимается разработкой продуктов по сбору и анализу данных из СМИ и соцмедиа.

Мы разрабатываем высоконагруженные системы, которые в режиме реального времени сканируют весь текстовый сегмент Интернета (100+ млн. сообщений в сутки, 1.7 млрд. метрик) и, используя уникальные лингвистические технологии, позволяют осуществлять мгновенный анализ упоминаний наших клиентов в социальных сетях, блогах, форумах и управлять их репутацией.



Что предстоит делать:

  • Обеспечивать полный цикл жизни реляционных (PostgreSQL, MySQL) и колоночных (Clickhouse) баз данных: от установки до тюнинга и масштабирования.
  • Проектировать и поддерживать отказоустойчивые кластеры брокеров сообщений (Kafka, RabbitMQ) под высокие нагрузки.
  • Управлять инфраструктурой BigData и системами потоковой обработки (Hadoop, NiFi, AirFlow), оптимизировать их производительность.
  • Настраивать и поддерживать системы кэширования и поиска (Redis, Elasticsearch).
  • Управлять S3-совместимым объектным хранилищем (MinIO), обеспечивать георезервирование и консистентность данных.
  • Настраивать надежные системы резервного копирования (бэкапы, PITR) и регулярно проверять планы аварийного восстановления (DR).
  • Выступать «куратором» 1-2 проектов: погружаться в бизнес-логику, помогать разработчикам с профилированием сложных запросов и проектированием схем данных.



Наш стэк:

  • БД: PostgreSQL, MySQL, Clickhouse.
  • Очереди и брокеры: Kafka, RabbitMQ.
  • BigData & ETL: Hadoop, Apache NiFi, Airflow.
  • Смежные системы: Redis, Elasticsearch, MinIO.

Требования к кандидату

  • Глубокое понимание внутреннего устройства реляционных БД (особенно PostgreSQL или MySQL): механизмы блокировок, индексы, репликация (streaming, logical).
  • Реальный опыт эксплуатации Apache Kafka в Production (настройка партиций, retention, решение проблем с лагом консьюмеров).
  • Опыт работы с Clickhouse (шардирование, репликация, движки таблиц).
  • Уверенное администрирование Linux (настройка ядра, дисковой подсистемы, сети под высокие нагрузки баз данных).
  • Опыт настройки высокодоступных (HA) конфигураций для БД (Patroni, PXC и т.д.).

    Будет плюсом:
  • Опыт эксплуатации стека Hadoop (HDFS, YARN) и инструментов ETL (Apache NiFi).
  • Навыки работы с Elasticsearch (управление индексами, ILM, масштабирование кластера).
  • Опыт деплоя стейтфул-приложений (баз данных, очередей) внутри Kubernetes с использованием Operators.
  • Навыки написания Ansible-ролей для автоматизации раскатки БД.
  • Умение писать скрипты на Python или Bash для автоматизации рутинных задач DBA.

Условия:

  • ДМС после испытательного срока;
  • специальные условия для сотрудников на страхование для членов семьи;
  • скидки в компаниях-партнерах (фитнес-центры, обучающие курсы, изучение иностранных языков и многое другое);
  • бесплатное онлайн-обучение на корпоративном портале и корпоративная библиотека;
  • офис в пешей доступности от ст. м. Дмитровская (БЦ «Савеловский Сити»).
Навыки
  • Hadoop
  • Redis
  • PostgreSQL
  • RabbitMQ
  • Elasticsearch
  • Clickhouse
Посмотреть контакты работодателя

Адрес

Похожие вакансии

СБЕР
  • Москва

  • Не указана

Рекомендуем
Альфа-Банк
  • Москва

  • Не указана

Рекомендуем
Spice IT
  • Москва

  • Не указана

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию