Добрый день!
Мы ищем Системного администратора Zabbix в компанию, которая является российским провайдером и поставщиком технологических решений и программного обеспечения для авиационной и туристической отраслей.
Обязанности:
- Поддержка и развитие инфраструктурных систем мониторинга и наблюдаемости, администрирование (Zabbix / Grafana / Prometheus / Nagios);
- Разработка и сопровождение шаблонов, триггеров, discovery-правил и кастомных проверок;
- Настройка дашбордов, алертинга и систем уведомлений;
- Интеграция мониторинга с CMDB, тикетингом и внутренними сервисами;
- Автоматизация рутинных задач с использованием Ansible, Bash и Python;
- Мониторинг Linux-инфраструктуры (Astra Linux / Ubuntu / RedHat-based systems);
- Анализ инцидентов, метрик и логов, участие в расследовании проблем производительности и отказов;
- Поддержка и сопровождение серверной инфраструктуры, сетевого оборудования и инженерных систем;
- Работа с физическими серверами, IPMI, LSI, RAID-контроллерами, сетевыми коммутаторами;
- Ведение и актуализация инфраструктурной документации и данных в NetBox;
- Взаимодействие с системными, сетевыми и DevOps-командами;
- Участие в развитии процессов мониторинга, автоматизации и observability.
Требования:
- Понимание принципов построения и эксплуатации ИТ-инфраструктуры;
- Уверенный опыт администрирования Linux-систем (Astra Linux / Ubuntu / Rocky Linux / RedHat);
- Опыт работы с системами мониторинга: Zabbix, Grafana, Prometheus, Nagios;
- Понимание принципов observability, сбора метрик, логирования и алертинга;
- Навыки сетевой диагностики (TCP/IP, DNS, DHCP, VLAN, routing), понимание модели OSI;
- Опыт работы с NetBox или аналогичными системами учета инфраструктуры;
- Умение анализировать логи, метрики и причины инцидентов;
- Базовые навыки автоматизации и написания скриптов (Bash / Python);
- Опыт работы с Ansible и инфраструктурой как кодом будет преимуществом;
- Понимание принципов работы серверного оборудования, СХД и сетевых устройств;
- Навыки работы с физическим оборудованием в серверных или дата-центрах;
- Способность грамотно эскалировать инциденты и эффективно взаимодействовать с техническими командами;
- Грамотная письменная и устная речь.
Будет плюсом:
- Опыт интеграции мониторинга с Jira, Service Desk или другими тикет-системами;
- Опыт работы с CI/CD-процессами;
- Знание Docker, Kubernetes или контейнерной инфраструктуры;
- Опыт настройки high availability и отказоустойчивых решений;
- Понимание принципов информационной безопасности и hardening Linux;
- Опыт работы в дата-центрах и сопровождения критичной инфраструктуры.
Условия:
- Официальное оформление по ТК РФ;
- Офисный формат работы (м. Университет дружбы народов);
- Работа в аккредитованной IT-компании;
- ДМС после прохождения испытательного срока;
- Работа в инфраструктурной команде с крупной распределённой инфраструктурой;
- Доступ к высоконагруженным и отказоустойчивым системам;
- Участие в развитии процессов мониторинга, автоматизации и observability;
- Работа с современным стеком мониторинга и автоматизации;
- Работа с современным оборудованием.
Будем ждать ваших откликов!