Разворачивать и поддерживать ML-инфраструктуру в Kubernetes: ML-модели, inference-сервисы, прикладные сервисы и необходимые инфраструктурные компоненты.
Проектировать, настраивать и оптимизировать инфраструктуру для ML/LLM inference, обеспечивать масштабирование, отказоустойчивость и эффективное использование вычислительных ресурсов.
Автоматизировать развертывание ML-сервисов и моделей с использованием Helm, ArgoCD и CI/CD, развивать GitOps-подходы.
Управлять инфраструктурой и облачными ресурсами через Terraform, разрабатывать и поддерживать Terraform-модули.
Развивать мониторинг и observability ML-систем: метрики, логирование, алертинг, контроль доступности и производительности inference-сервисов.
Совместно с ML- и backend-разработчиками улучшать процесс вывода решений из эксперимента в production и инструменты для разработки, тестирования и эксплуатации ML-систем.
Требования
опыт 3+ лет в DevOps/MLOps или ML-разработке;
владение Kubernetes и облачными технологиями;
навыки работы с Helm, ArgoCD и написание Terraform-модулей;
практика работы с мониторингом, логированием и ML-инференс серверами.
ДМС со стоматологией и льготными условиями для членов семьи
Технику для работы
График работы 5/2
Работу в максимально уютном офисе в центре Москвы (ст. м. Савеловская), в Краснодаре или удаленно из других городов РФ, так же есть офисы в Санкт-Петербурге (ст. м. Балтийская) и в Иннополисе
Возможность реализовать свой опыт и потенциал в интересных и многоплановых проектах
Развитие – мы оплачиваем обучение на курсах и участие в конференциях
Возможность проведения и участия в митапах, хакатонах, где есть возможность познакомиться с работой других подразделений
Наличие корпоративных скидок PRIMEZONE и программ лояльности от компании
Наличие корпоративной библиотеки курсов
Возможность рекомендовать компанию своим друзьям, участвуя в реферальной программе