Команда АЛЬФА-МОБАЙЛ это мобильный виртуальный оператор для клиентов одного из крупнейших банков страны – «Альфа-Банка», признанного в 2024 году технологическим лидером в области финтех. Команда MVNO - это команда профессионалов с многолетним опытом в Телеком и ИТ. Мы объединяем в себе передовые технологии в области коммуникации.
Мы развиваем внутреннюю AI-платформу для запуска и эксплуатации AI/ML/LLM-сервисов. Ищем инженера уровня Pre-Middle, который уже имеет хорошую DevOps-базу и хочет развиваться в сторону AI Infrastructure / MLOps.
В этой роли предстоит не только сопровождать инфраструктуру, но и постепенно участвовать в проектировании и развитии платформы: Kubernetes, CI/CD, storage, observability, GPU-инфраструктура и сервисы инференса
Чем предстоит заниматься:
- Развивать и сопровождать инфраструктуру AI-платформы.
- Разворачивать и поддерживать сервисы в Kubernetes.
- Контейнеризировать приложения и инфраструктурные компоненты с использованием Docker.
- Разрабатывать и поддерживать CI/CD-пайплайны.
- Автоматизировать рутинные операции с помощью Python и Bash.
- Работать с ArgoCD и IaC-инструментами.
- Настраивать мониторинг, логирование и health-checks.
- Работать с persistent storage и S3/object storage.
- Участвовать в эксплуатации AI/ML-сервисов и LLM inference, администрировать AI системы.
- Постепенно осваивать GPU-инфраструктуру и особенности запуска AI-сервисов на GPU.
- Участвовать в развитии внутренних стандартов deployment и эксплуатации AI-сервисов.
- Разбираться в инцидентах и самостоятельно доводить технические задачи до результата.
- Взаимодействовать с архитекторами, разработчиками, специалистами по кибербезопасности, ML-инженерами и системными администраторами
Требования: - Уверенное владение Linux и командной строкой.
- Практический опыт с Docker и Docker Compose.
- Базовый практический опыт работы с Kubernetes.
- Понимание основных Kubernetes-объектов: Pod, Deployment, Service, ConfigMap, Secret, Ingress, PVC.
- Опыт работы с Git.
- Понимание принципов CI/CD и практический опыт работы хотя бы с одним CI/CD-инструментом.
- Bash на уровне написания небольших скриптов автоматизации.
- Python на уровне написания automation scripts и небольших сервисных утилит.
- Базовое понимание сетей: TCP/IP, DNS, HTTP/HTTPS.
- Понимание принципов мониторинга и логирования.
- Понимание разницы между файловым, блочным и объектным хранилищем.
- Понимание базовых принципов работы AI/ML-сервисов: model, training, inference, embeddings, LLM
- Понимание базовых принципов применения мер защиты от киберугроз
Будет плюсом:
- Helm, Ansible
- ArgoCD / GitOps.
- Prometheus / Grafana / Loki.
- S3 / MinIO.
- PostgreSQL / Redis.
- Опыт работы с GPU и NVIDIA.
- NVIDIA Container Toolkit / CUDA.
- vLLM, SGLang, Triton или другие inference engines.
- MLflow, Airflow, Kubeflow или другие MLOps-инструменты.
- RAG, vector databases, embeddings.
- Непосредственный опыт эксплуатации AI/ML или LLM-сервисов.
- Опыт работы в инфраструктурной или DevOps-команде.
- Опыт эксплуатации production-систем.
- Опыт работы с on-premise инфраструктурой.
- Опыт работы с Linux-серверами и Kubernetes-кластерами.
- Понимание принципов отказоустойчивости и масштабирования.
- Английский язык на уровне чтения технической документации.
Мы не ожидаем глубоких знаний ML и разработки нейронных сетей.
Не требуется самостоятельно обучать модели или разрабатывать ML-алгоритмы.
Важнее хорошая инженерная база, способность самостоятельно разбираться в проблемах и готовность постепенно углубляться в AI infrastructure.
Условия: - Стабильный и прозрачный доход: размер заработной платы обсуждается по итогам собеседования + премия по результатам KPI
- Сложные и интересные задачи, современный стек технологий
- Заботу о вашем здоровье: программа ДМС с первых дней работы, куда входит стоматология, обслуживание в лучших клиниках города
- Возможность вертикального и горизонтального карьерного роста: регулярно проходят тренинги, вебинары, митапы и демо-дни
- Корпоративные предложения от партнёров группы АЛЬФА-БАНК
- Бесплатная мобильная связь Альфа-Мобайл.