Data Engineer в направление «Интеллектуальные решения»

Транстелеком

Data Engineer в направление «Интеллектуальные решения»

Астана, улица Динмухамеда Кунаева, 10

Описание вакансии

Ключевые задачи:
  • Строить пайплайны выгрузки данных из систем заказчика: PostgreSQL, Oracle, Hive-таблицы, Kafka-топики, файлы, API;
  • Разрабатывать и сопровождать DAG'и в Airflow - инкрементальная загрузка, ретраи, алертинг, восстановление после сбоев;
  • Собирать витрины для аналитики и датасеты для AI-сервисов;
  • Отвечать за качество данных: проверки на входе, контроль расхождений, понятная диагностика при инцидентах;
  • Оптимизировать запросы и модели данных, когда витрина перестаёт укладываться в SLA;
  • Мы строим корпоративную AI-платформу: интеллектуальный поиск по внутренним документам, аналитику операционных процессов, выявление аномалий в данных. Всё это работает ровно настолько хорошо, насколько хорош слой данных под ним. Ландшафт неоднородный, и мы говорим об этом сразу. Источники живут в унаследованном контуре заказчика на Huawei Cloud Stack - Hive, Spark, объектное хранилище, базы на Oracle и PostgreSQL. Наш собственный контур современный: Kubernetes, Airflow, аналитическая СУБД, GPU-сегмент под инференс.

  • Ваша задача - аккуратно вытащить данные из первого и качественно уложить во второй.

Навыки, которые нам необходимы:
  • 3 + года в роли Data Engineer или близкой - ETL, DWH, backend с дата-уклоном;
  • Уверенный SQL: оконные функции, планы выполнения, умение объяснить, почему запрос тормозит;
  • PostgreSQL на практике - индексы, блокировки, партиционирование;
  • Python на уровне промышленной разработки пайплайнов, а не разовых скриптов;
  • Airflow или другой оркестратор - Dagster, Prefect, аналог;
  • Опыт хотя бы с одной аналитической СУБД: ClickHouse, Greenplum, GaussDB(DWS), Vertica;
  • Понимание распределённого хранения: HDFS, Hive-таблицы, движок вроде Spark. Конкретный дистрибутив не важен;
  • Docker: собрать образ, разобраться, почему контейнер падает;
  • Будет плюсом знание: Huawei Cloud Stack (MRS, GaussDB, OBS); Kafka и CDC (Debezium); Orac как источник; dbt; Kubernetes; Spark; Prometheus и Grafana; Data Quality и Data Contracts; подготовка данных для ML: обработка документов, векторные хранилища, эмбеддинги.

То, что ждет вас в команде:
  • Работа в стабильной и динамичной Компании;
  • Карьерный рост;
  • Социальный пакет по Коллективному договору
  • Отпуск 28 дней;
  • Яркая корпоративная жизнь.
Навыки
  • ETL
  • DAG
  • PostgreSQL
Посмотреть контакты работодателя

Адрес

Похожие вакансии

Documentolog
  • Астана

  • Не указана

Рекомендуем
Народный банк Казахстана

Эксперт data engineer

Народный банк Казахстана

  • Астана

  • Не указана

Рекомендуем
Armeta KZ

AI-Engineer

Armeta KZ

  • Астана

  • Не указана

Рекомендуем
  • Астана

  • до 4000 USD

ЧК FDM Tech Ltd.
  • Астана

  • до 500000 KZT

Казахский Водоканалпроект
  • Астана

  • до 500000 KZT

Казахский Водоканалпроект

Главный инженер проекта (ГИП)

Казахский Водоканалпроект

  • Астана

  • до 500000 KZT

INK architects (Ай Эн Кей архитектс)

Инженер-проектировщик АПТ

INK architects (Ай Эн Кей архитектс)

  • Астана

  • до 500000 KZT

ForteBank

AI Engineer

ForteBank

  • Астана

  • до 500000 KZT

NTS design
  • Астана

  • до 1300000 KZT

  • Астана

  • до 1000000 KZT

Elite Business Group

Senior DevOps Engineer

Elite Business Group

  • Астана

  • до 1000000 KZT

Ведущий инженер-строитель

Center Professional Engineering

  • Астана

  • до 1200000 KZT

ОФ Heart Center Foundation

Embedded software engineer

ОФ Heart Center Foundation

  • Астана

  • до 1300000 KZT

Хотите оставить вакансию?

Заполните форму и найдите сотрудника всего за несколько минут.
Оставить вакансию