Aston — аккредитованная аутсорсинговая IT-компания, работающая с 2007 года. Наш штат насчитывает 2500+ специалистов. Мы разрабатываем программное обеспечение и IT-решения в сферах Finance, Healthcare, eCommerce, IoT, Media, Big Data, ML и многом другом.
Предлагаем присоединиться в роли DevOps Engineer и работать над проектом заказчика.
Заказчик – это российское подразделение американской семейной компании одного из крупнейших производителей продуктов питания и кормов для животных. Компания работает на рынке России и стран СНГ с 1991 года.
Обязанности
- эксплуатировать и оптимизировать Kubernetes-кластеры, обеспечивая отказоустойчивость, автоскейлинг и мониторинг контейнерной инфраструктуры;
- разрабатывать и поддерживать ETL-пайплайны в Apache Airflow, включая обработку ошибок, версионирование DAG и деплой в k8s;
- управлять базами данных (PostgreSQL, ClickHouse): настраивать репликацию, бэкапы, оптимизировать производительность и выполнять миграции с минимальным downtime;
- внедрять практики Data Mesh / Data Governance и DevOps-процессы: IaC, управление секретами, инцидент-менеджмент и disaster recovery.
Требования
- опыт работы в роли DevOps Engineer от 3-х лет;
- владение Kubernetes и контейнерной инфраструктурой;
- навыки эксплуатации кластера: обновление без простоя (rolling, PDB, drain), диагностика подов (OOM, throttle, eviction), persistent storage для stateful-нагрузок;
- опыт работы с автоскейлингом HPA/VPA/Cluster Autoscaler; понимание metrics pipeline, custom metrics, ограничения и взаимодействие механизмов;
- навыки мониторинга кластера: ключевые метрики (CPU, memory, PVC, restarts, node pressure, API latency); алертинг через Prometheus/встроенный мониторинг облака;
- опыт работы с IaC для k8s: Terraform/Helm для развертывания кластеров и приложений; модульность, параметризация, CI/CD для манифестов;
- опыт работы с Apache Airflow и ETL-оркестрацией;
- понимание архитектуры и executor: обоснованный выбор executor (Local/Celery/Kubernetes) под объём и изоляцию; деплой Airflow в k8s через Helm;
- умение обрабатывать ошибки и retry;.
- навыки мониторинга и оптимизации DAG;
- навыки версионирования и деплоя DAG: GitSync vs образ vs CI/CD pipeline; семантическое версионирование, rollback, изоляция сред (dev/staging/prod);
- опыт работы с базами данных и хранилищами: OLTP (PostgreSQL) vs OLAP (ClickHouse); понимание границ применимости, распределённых таблиц, движков хранения;
- навыки настройки репликации, PITR, автоматические/ручные бэкапы; понимание RPO/RTO, тестирование восстановления;
- навыки performance и оптимизации: Query profiling (pg_stat, system.query_log), индексы, партиционирование, materialised views; диагностика медленных запросов;
- опыт работы с миграцией данных;
- опыт работы с IaC и конфигурацией: Terraform для облака (сети, ВМ, managed-сервисы); управление секретами (Vault/Lockbox/External Secrets), rotation, least privilege;
- навыки мониторинга и алертинга: метрики и логи инфраструктуры и приложений; дашборды, SLO/SLI, on-call; tracing для ETL-пайплайнов;
- навыки диагностики деградации ETL, восстановление упавшего scheduler'а, миграция больших объёмов; blue-green deployment с минимальным риском.
Будет плюсом
- опыт работы с Apache Kafka, Apache Spark;
- знание Python/Go для автоматизации;
- наличие сертификатов CKA/CKAD;
- опыт работы с другими облаками (AWS/GCP/Azure);
- понимание принципов децентрализованной архитектуры данных (Data Mesh) и практик управления данными (Data Governance).
Что мы предлагаем
- конкурентная зарплата, сумму обсуждаем отдельно с каждым кандидатом;
- проекты от топовых компаний;
- оформление по ТК;
- возможность выбирать формат работы: из дома, из офиса или гибридный;
- комфортные офисы в городах-центрах разработки;
- медицинская страховка (+стоматология);
- sick-days, оплачиваемый бенч, отпуск и больничные;
- частичная компенсация спортивных абонементов и компенсация расходов на оплату коворкинга;
- доплаты за менторство, ведение обучающих курсов, ревью проектов и участие в других профактивностях компании;
- прозрачная система Performance Review и ментор на все время работы;
- поэтапная система адаптации новых сотрудников;
- корпоративный портал с материалами для изучения любого нового стека и повышения уровня по своей специальности и не только;
- участие в технических митапах и конференциях в качестве гостя и спикера;
- корпоративы и тимбилдинги;
- детские праздники и мастер-классы с подарками и сладостями для семей сотрудников.