Мы разрабатываем Yandex MPP Analytics Engine for PostgreSQL — сервис Yandex Cloud для управления кластерами MPP-БД на основе PostgreSQL: Greenplum и Apache Cloudberry. Наш сервис берёт на себя весь lifecycle кластера — provisioning, бэкапы, обновления, мониторинг, отказоустойчивость — так, чтобы клиент смог сфокусироваться на решении своих бизнес-задач, а не на эксплуатации.
У нас сравнительно небольшая аудитория, клиентов немного, но все крупные. В основном это ритейл, финтех и промышленные предприятия. Наш сервис помогает решать нетривиальные задачи аналитики, от которых зависят бизнес-процессы наших клиентов. Суммарно под управлением — петабайты данных.
Ключевая особенность нашего сервиса — фокус на стабильность. У нас фактически нет права на деградацию — и это интересно как инженерная задача: она заставляет по-настоящему вкладываться в архитектуру, тестирование и наблюдаемость.
Технический стек
Задачи в команде нетривиальные и близкие к «сердцу» распределённых систем: консенсус, репликация, отказоустойчивость под реальной нагрузкой.
Разрабатывать облачные API и сервисы
Наши API и сервисы автоматизирут полный lifecycle MPP-СУБД: создание кластеров, масштабирование, обновления, бэкапы, восстановление, failover.
Развивать инфраструктурную автоматизацию
Управление конфигурациями, деплой, внутренние тулы для операционных задач.
Отвечать за качество и надёжность
SLO, наблюдаемость, тюнинг производительности, разбор инцидентов и работа над тем, чтобы они не повторялись.
Участвовать в проектировании
Design review, обсуждение архитектурных решений, выбор компромиссов между надёжностью, стоимостью и скоростью доставки фич.
Больше о бэкенде в Яндексе — в канале Yandex for Backend