Продуктовая IT-компания. Делаем B2C-сервисы на базе AI, которыми пользуются люди в России, СНГ и за рубежом. Создаем веб-приложения и зарабатываем на подписке.
Ищем сильного инженера с опытом управления небольшой командой, который возьмёт на себя инфраструктуру, надёжность, наблюдаемость и безопасность компании.
Это роль играющего тренера: около 60–70% времени предстоит работать руками, остальное — управлять командой из 2–3 человек, планировать развитие инфраструктуры и взаимодействовать с бизнесом. Подчинение напрямую генеральному директору, ключевой партнёр — CTO.
Задачи:
-
Обеспечивать стабильность bare-metal серверов, виртуализации, сетей, PostgreSQL, RabbitMQ и S3-хранилищ.
-
Развивать мониторинг, логирование, трейсинг, алертинг и on-call.
-
Управлять инцидентами, проводить постмортемы и учения по восстановлению.
-
Отвечать за бэкапы, репликацию, DR-планы и регулярную проверку восстановления.
-
Управлять доступами, секретами, VPN, патчами и инфраструктурной безопасностью.
-
Автоматизировать инфраструктуру с помощью Ansible, Terraform и скриптов.
-
Поддерживать GitLab, CI-раннеры, SSO, wiki и другие внутренние сервисы.
-
Планировать мощности, бюджет и работу с провайдерами и подрядчиками.
-
Руководить небольшой командой: ставить задачи, развивать сотрудников и не становиться единственной точкой отказа.
-
Формировать требования к эксплуатации сервисов и договариваться с разработкой об их реализации.
Что важно:
-
От 6 лет опыта в эксплуатации и инфраструктуре.
-
От 1–2 лет руководства небольшой инженерной командой.
-
Глубокое знание Linux, сетей и диагностики производительности.
-
Практический опыт с bare-metal, RAID, IPMI и виртуализацией — Proxmox, KVM или VMware. Опыт только с облаками не подойдёт.
-
Эксплуатация PostgreSQL: репликация, PITR, Patroni или аналоги, pgBackRest/WAL-G, анализ производительности.
-
Работа с RabbitMQ и S3-совместимыми хранилищами.
-
Prometheus, Grafana, Loki/Alloy или аналогичный стек наблюдаемости.
-
Ansible обязательно, Terraform желательно.
-
Docker и docker compose; понимание, когда Kubernetes действительно нужен.
-
Vault, SSO/LDAP, принцип минимальных привилегий и аудит доступов.
-
Bash и Python или Go.
-
Понимание эксплуатации PHP/Laravel: php-fpm, OPcache, воркеры и типичные узкие места.
-
Способность спокойно действовать во время инцидентов и объяснять технические риски на языке денег и последствий.
Работа с AI
AI-ассистенты — обязательная часть инженерной практики. Ожидаем ежедневное использование Claude Code, Cursor или аналогов для работы с IaC, скриптами, логами, runbook’ами и постмортемами.
Важно уметь внедрять AI-сценарии в процессы команды, критически проверять результат и понимать ограничения безопасности: какие данные можно передавать моделям и какой доступ допустимо давать агентам.
Будет плюсом:
-
Опыт аудитов ИБ, PCI DSS, требований ЦБ, ФСТЭК и 152-ФЗ.
-
Работа с SIEM, IDS и WAF.
-
Миграция между дата-центрами без простоя.
-
FinOps и оптимизация инфраструктурных расходов.
Мы предлагаем:
-
Оклад и квартальная премия, детальнее обсуждаем на собеседовании
-
Самописная аналитическая система в реальном времени — все показатели по всем кампаниям, без выгрузок и ожидания отчётов
-
Доступ к корпоративному Claude и другим ИИ-ассистентам — без лимитов и заявок
-
Предоставляем сервисы, необходимые для работы — аналитика, парсеры, подписки, доступы к профильным платформам
-
Быстрые согласования гипотез и большой простор для тестирования — идея проверяется, а не защищается месяцами
-
ДМС — после года сотрудничества
-
Оплачиваемый отгул — 28 дней в год
-
Day-off — 1 день в месяц без отработки
-
Команда ~ 35 человек, полностью распределённая — работаем на результат, а не на присутствие в календаре