Наш отдел крайне важен для Яндекс Поиска, а именно для центральной его части — поисковой строки с Алисой.
Одной из основополагающих частей любого машинного обучения являются датасеты. Мы отвечаем за ускорение и удешевление процесса их сбора. От этого зависит частота релизов, которые напрямую влияют на пользователей Поиска. Наша команда работает с быстро развивающимися продуктами на стыке ML и краудсорсинга.
Встраивание ML-моделей в инфраструктуру разметок
Современные генеративные модели позволяют получить качество разметки, сопоставимое с человеческой или даже лучше, на простых задачах, а также ускорить процесс разметки асессорами сложных задач при помощи генеративных подсказок. Задача заключается в построении надёжных пайплайнов инференса моделей, их оптимизации и сборе дополнительных данных, необходимых для применения моделей.
Построение витрины разметок
В Поиске есть несколько крупных (по бюджету и количеству заданий) разметок, и в них в разной степени внедрены ML-модели. Необходимо построить единую витрину, где можно было бы увидеть объёмы разметки, полученной от асессоров и моделей, степень внедрения этих моделей, затраты на разные компоненты и другие показатели.
Больше о бэкенде в Яндексе — в канале Yandex for Backend
Мы регулярно устраиваем командные и кросс-командные обеды и тимбилдинги. Любим поиграть в покер, преферанс, кикер и бильярд в офисе, а по вечерам — в Dota 2 и CS2. Иногда выбираемся на концерты или в бары.