Мониторинг состояния инфраструктуры и сервисов: Grafana/Prometheus, Kubernetes, Linux-серверы и инфраструктурные компоненты;
Работа с логами и мониторингом: поиск ошибок и аномалий, обработка алертов, первичный анализ возникающих проблем;
Первичная диагностика инцидентов: сбор и анализ логов и метрик, локализация проблемы, выполнение базовых действий по устранению или эскалация;
Сопровождение Kubernetes-кластеров и работающих в них сервисов, выполнение типовых эксплуатационных операций;
Работа с инфраструктурными компонентами: PostgreSQL/Patroni, Redis/Sentinel, Ceph, HAProxy/Keepalived;
Сопровождение тестовых окружений и участие в проверке изменений перед внедрением в Production;
Работа с CI/CD и GitLab Runner: первичный анализ проблем сборки и деплоя;
Выполнение повседневных Linux и сетевых задач: диагностика сервисов, дисков, DNS, сетевой связности, сертификатов и доступности систем;
Участие в разборе инцидентов и подготовке post-mortem;
Ведение и актуализация технической документации, инструкций и инфраструктурных схем;
Работа с IaC и постепенная автоматизация повторяющихся эксплуатационных операций;
Взаимодействие с разработчиками и смежными техническими командами при решении инфраструктурных вопросов.
Базовое понимание Linux и желание развиваться в системном администрировании / DevOps / SRE;
Умение работать с Linux CLI и понимание базовых команд диагностики системы;
Базовое понимание компьютерных сетей: TCP/IP, DNS, HTTP/HTTPS, порты и сетевое взаимодействие;
Понимание принципов работы клиент-серверных приложений;
Базовые знания Git;
Способность читать техническую документацию и самостоятельно искать информацию;
Готовность разбираться в незнакомых системах и технологиях;
Внимательность при работе с инфраструктурой и понимание необходимости согласования потенциально опасных изменений;
Умение последовательно диагностировать проблему: собрать информацию, сформировать гипотезу и проверить её;
Адекватная коммуникация и готовность своевременно сообщать о проблемах и задавать вопросы.
Практический опыт работы или домашние проекты с Docker и Kubernetes;
Знакомство с Grafana, Prometheus или другими системами мониторинга;
Знакомство с GitLab CI/CD;
Опыт работы с Ansible, Terraform или другими IaC/automation-инструментами;
Базовое знакомство с PostgreSQL, Redis, HAProxy, Ceph;
Опыт написания Bash/Python-скриптов;
Понимание принципов High Availability и отказоустойчивых систем;
Опыт работы системным администратором, инженером технической поддержки или эксплуатации;
Глубокий практический опыт со всем перечисленным стеком не требуется — ищем junior-специалиста с хорошей технической базой, системным мышлением и желанием развиваться в направлении Infrastructure / DevOps / SRE.
Конкурентная заработная плата — обсудим по итогам интервью;
Удаленный формат работы;
График 5/2: с 09:00 до 18:00 или с 10:00 до 19:00;
Предоставляем мощный рабочий ноутбук;
100% компенсация больничных;
Скидка на изучение английского языка в Skyeng.