Администрирование и развитие гибридной инфраструктуры, включающей bare-metal серверы и виртуальные среды;
Эксплуатация и сопровождение кластеров оркестрации Nomad и Kubernetes (K8S);
Реализация подходов Infrastructure as Code с использованием стека Terraform и ArgoCD
Обеспечение наблюдаемости сервисов: администрирование систем мониторинга (Prometheus) и централизованного логирования (ELK);
Операционное сопровождение СУБД MySQL(Vitess), Redis и ClickHouse под нагрузкой
Разработка автоматизированных скриптов и утилит на Bash и Python для выполнения рутинных операций и реагирования на события;
Участие в Capacity Planning — оценка текущей утилизации, прогнозирование роста нагрузки и планирование ресурсов;
Расследование инцидентов и выработкой мер по предотвращению повторных сбоев;
Участие в сменной поддержке критических инцидентов (подключение по необходимости в нерабочее время);
Взаимодействие со смежными командами в рамках кросс-проектной деятельности, работа с CI/CD на базе TeamCity.
Что мы ищем:
Глубокое системное понимание архитектуры Linux (планировщик процессов, подсистема ввода-вывода, сетевой стек);
Коммерческий опыт работы с Kubernetes и Nomad: знание внутренней архитектуры, сетевых взаимодействий, политик безопасности и стратегий обновления;
Уверенное владение Bash и Python на уровне, достаточном для написания поддерживаемого и документируемого кода;
Практический опыт применения GitOps-подходов: Terraform (управление состоянием, модульная структура) и ArgoCD;
Опыт эксплуатации Prometheus (включая написание запросов PromQL и настройку AlertManager) и стека ELK (настройка индексации, визуализация в Kibana);
Опыт эксплуатации MySQL (репликация, оптимизация запросов, параметрическая настройка), Redis и ClickHouse. Плюсом будем опыт эксплуатации MySQL в связке с Vitess;
Понимание аппаратного обеспечения серверного уровня: RAID-массивы, BIOS/UEFI, процессорные характеристики, показатели энергопотребления и охлаждения и тд;
Навыки расследования инцидентов: системный подход к диагностике, исключающий необоснованные перезагрузки и временные «костыли».
Будет плюсом:
Опыт Capacity Planning — построение прогнозных моделей утилизации ресурсов.
Мы предлагаем:
расширенный ДМС со стоматологией — с первого рабочего дня;
100% оплата больничного (30 дней в год);
материальный бонус при рождении ребенка, ведение беременности, ДМС и подарки детям;
телемедицина и медицинская поддержка 24/7;
полис страхования от критических заболеваний;
материальная помощь в особых случаях;
занятия английским языком;
корпоративные скидки;
дополнительное профессиональное обучение;
компенсация затрат на спорт — занятия в фитнес-клубе, индивидуальные тренировки и участия в соревнованиях.