Мы в поиске Devops-инженера с экспертизой в on-premise инфраструктуре на базе OpenStack с фокусом на виртуализацию KVM, SDN-сети и Ceph-хранилища.
Чем предстоит заниматься:
- Развёртывать кластер OpenStack с нуля: проектирование архитектуры, установка, настройка всех сервисов (vanilla или через дистрибутив - Charmed, RHOSP, Mirantis).
- Мигрировать виртуальные машины и данные с VMware vSphere/ Hyper-V/других платформ на OpenStack.
- Добавлять новые вычислительные узлы, контроллеры, хранилища без прерывания работы сервисов.
- Поддерживать production-кластера OpenStack в режиме 24/7: мониторинг, реакция на алерты, разбор инцидентов.
- Диагностировать и устранять сбои на всех уровнях: вычислительные узлы (Nova), сети (Neutron), хранилища (Cinder/Ceph), аутентификация (Keystone), образы (Glance).
- Анализировать логи всех компонентов OpenStack и связанной инфраструктуры для выявления root cause.
- Оптимизировать сетевой стек: настройка OVS/OVN, VXLAN offloading, DPDK, SR-IOV для снижения latency.
- Автоматизировать CI/CD для инфраструктурных изменений: pipeline'ы для тестирования и деплоя конфигураций.
- Разрабатывать скрипты (Python/Bash) для интеграции с API OpenStack, автоматизации биллинга, отчётности.
Для нас важно:
- Опыт работы от 5 лет в системном администрировании, DevOps или SRE.
- От 3 лет практического опыта эксплуатации и администрирования OpenStack в production-средах (кластеры от 50+ физических узлов).
- Опыт работы в режиме on-call, разбора P0/P1 инцидентов и написания post-mortem.
- Опыт руководства/менторства команды middle/junior инженеров.
- Экспертный уровень администрирования Linux (RHEL, Ubuntu, Debian) - тюнинг ядра, namespaces, cgroups, systemd, SELinux.
- Глубокое понимание KVM/QEMU/libvirt: оптимизация производительности, NUMA, CPU pinning, hugepages, SR-IOV, PCI-passthrough.
- Опыт работы с real-time kernels и low-latency конфигурациями.
- Глубокое понимание архитектуры и взаимодействия всех core-сервисов: Nova, Neutron, Cinder, Glance, Keystone, Horizon, Swift, Placement.
- Опыт проектирования, развёртывания и миграции кластеров OpenStack с нуля (любой дистрибутив).
- Умение читать исходный код сервисов OpenStack (Python) для диагностики багов и понимания логики работы.
- Опыт патчинга/обновления OpenStack, управления жизненным циклом кластера.
- Опыт работы с Ironic (bare metal provisioning) - желательно.
- Понимание multi-region / multi-cell архитектур Nova.
- Экспертный уровень Ansible: написание сложных ролей, кастомных модулей, коллекций, динамических инвентарей
- Опыт работы с Terraform для управления инфраструктурой как кодом.
- Опыт построения CI/CD pipelines для инфраструктуры (GitLab CI, Jenkins, GitHub Actions).
- Опыт работы с GitOps (ArgoCD, Flux) - желательно.
- Навыки разработки на Python (автоматизация, интеграция с API OpenStack).
Главный принцип SkillStaff - Выбирай!
- РАЗНООБРАЗИЕ ПРОЕКТОВ. Выбирай из сотен компаний и проектов то, что интересно и полезно для твоего роста. SkillStaff помогает реализовывать ежегодно порядка 500 различных ИТ-проектов для крупного бизнеса.
- КОМФОРТ. SkillStaff — аккредитованная IT-компания, белая зарплата и удобный график работы. Создавай идеальные условия для своей работы: удаленная работа или возможность работать как в офисе клиента, так и в комфортном офисе SkillStaff в центре Москвы на Воздвиженке.
- РАЗВИТИЕ. Выбирай сам путь, по которому ты хочешь развиваться. Используй возможность обмена опытом и получение знаний через участие в разных проектах, совместную работу с высококвалифицированными коллегами.
- КУЛЬТУРА. Нашу культуру создают сами сотрудники – мы их слышим и помогаем развиваться, чтобы #вместе переходить на новый уровень!