Алматы, улица Наурызбай батыра, 17А
Метро: Абая
Задачи:
Обеспечение доступности и стабильной работы централизованных DevOps-сервисов (GitLab, Kubernetes, OpenShift, Elastic Stack, VAST DataStore, NGINX/HAProxy, Nexus, Vault/OpenBao, Prometheus/Grafana);
Мониторинг состояния инфраструктуры, кластеров и платформ, реагирование на предупреждения и аварийные события;
Диагностика и устранение инцидентов, проведение анализа первопричин (RCA) и разработка корректирующих и предупреждающих мероприятий;
Выполнение регулярного обновления и патчинга ОС, платформ и ПО, контроль сроков действия сертификатов, ключей, лицензий и технических учётных записей;
Проектирование и внедрение новых централизованных сервисов, развитие существующих платформ с учётом роста числа компаний, пользователей и проектов;
Стандартизация архитектуры и конфигураций, автоматизация предоставления сервисов, планирование емкости и масштабирования инфраструктуры;
Участие в разработке архитектуры высокой доступности и аварийного восстановления, тестирование отказоустойчивости и восстановления платформ;
Организация onboarding новых компаний и команд: создание проектов, групп, пространств имен, репозиториев и политик доступа;
Консультирование команд разработки и эксплуатации, контроль соблюдения стандартов использования платформ и участие в решении межкомандных технических проблем;
Поддержание в актуальном состоянии эксплуатационной документации, инструкций и регламентов для компаний-потребителей.
Мы ожидаем от кандидата:
Высшее техническое образование;
Опыт работы в DevOps, Platform Engineering или системном администрировании от 3 лет;
Опыт эксплуатации Linux-систем (преимущественно RHEL и совместимых дистрибутивов): systemd, управление пакетами, права доступа, диагностика и базовый hardening;
Практический опыт работы с Kubernetes в продуктивной среде: ключевые объекты кластера, RBAC, Helm, диагностика типовых сбоев;
Практический опыт работы с GitLab CI/CD: пайплайны, GitLab Runner, управление доступами, резервное копирование и обновление;
Опыт работы с Docker и контейнерными образами;
Опыт работы с Prometheus и Grafana: PromQL, alerting rules, дашборды;
Опыт настройки NGINX или HAProxy: L4/L7-балансировка, reverse proxy, TLS termination;
Опыт автоматизации с использованием Bash, Python или Ansible;
Понимание сетевых технологий (TCP/IP, DNS, TLS, маршрутизация) и принципов информационной безопасности (минимальные привилегии, RBAC, безопасное хранение секретов);
Опыт сопровождения продуктивных систем и расследования технических инцидентов;
Опыт работы с Jira и Confluence либо аналогичными системами;
Умение разрабатывать техническую и эксплуатационную документацию.
Будет плюсом:
Опыт работы с Red Hat OpenShift и Hosted Control Planes;
Опыт эксплуатации GitLab в распределённой или высокодоступной архитектуре;
Опыт работы с Elastic Stack, Nexus Repository, HashiCorp Vault или OpenBao;
Опыт работы с VAST DataStore или аналогичными корпоративными системами хранения;
Опыт применения Terraform, Helm, Argo CD и практик GitOps;
Опыт построения мультиарендных платформ и централизованных сервисов для нескольких юрлиц или подразделений;
Опыт работы в крупных распределённых организациях;
Опыт проектирования Disaster Recovery, участия в дежурствах и устранении критических инцидентов.
Что мы предлагаем:
Профессиональный коллектив;
Возможность работать над проектами, приносящими пользу для тысяч людей;
Неограниченный рост;
Бонусы и уникальные предложения от компаний холдинга;
Спонсирование профессионального обучения;
Насыщенная корпоративная жизнь с выездами на природу, праздничными мероприятиями в офисе, играми и розыгрышами подарков.
Connectivity Solutions (Коннективити Солюшнз)
Алматы
до 400000 KZT