Ищем сильного Senior Python Backend Engineer, который возьмёт ownership основного AI-бэкенда продукта и интеграций с LLM и media-generation пайплайнами.
Задачи: - Разработка и развитие production-бэкенда на Python.
- Проектирование API, бизнес-логики, асинхронных задач и очередей.
- Интеграция LLM через API: prompts, tool calling, structured outputs, routing, retries/fallbacks, работа с контекстом.
- Интеграция ML-решений команды в продукт.
- Поддержка генерации изображений и видео через ComfyUI / inference services.
- Работа с GPU-провайдерами, очередями и оркестрацией inference.
- Мониторинг, health checks, failover и повышение reliability.
- Диагностика production-инцидентов.
- Самостоятельный ownership архитектуры и технических решений в своей зоне.
Требования: - Сильный production Python.
- Опыт с FastAPI или аналогичными web-frameworks.
- Хорошее понимание async/await и concurrency.
- PostgreSQL, Redis.
- Очереди и background jobs.
- Docker, Linux.
- Опыт проектирования и поддержки production-сервисов.
- Понимание retries, idempotency, caching, observability.
- Практический опыт интеграции LLM или других ML-моделей в production.
- Понимание работы LLM API, prompt/system prompt, tool calling и structured generation.
- Самостоятельность и способность брать технический ownership без постоянного контроля.
Будет плюсом: - ComfyUI.
- Image/video generation pipelines.
- RunPod, Vast, Lambda или другие GPU-провайдеры.
- Kubernetes / Helm.
- Prometheus / Grafana / Sentry.
- ClickHouse.
- Langfuse или другая LLM observability.
- Опыт с agents / tool-based systems.
- vLLM, OpenAI, Anthropic, OpenRouter и аналогичные API.
Что не требуется: - Это не research ML-позиция. Не нужны глубокие знания обучения LLM, RL/RLHF, CUDA, distributed training или разработки собственных моделей.
- Основной фокус роли — сильный Python backend + production AI integrations + базовый MLOps/inference.
Условия: - Полностью удаленный формат.
- Гибкий график.
- Достойная заработная плата.