Наша команда развивает продвинутые способности Alice AI LLM, обучая наши модели решать самые нетривиальные задачи.
Мы обучаем единую рассуждающую модель Alice AI, которая объединяет в себе модальности, рассуждения и использование тулов. Фокусируемся на сценариях, где требуется сложный ризонинг, написание качественного кода и уверенное использование инструментов, таких как CodeSandbox и поиск.
Наша ключевая цель — сделать Алису экспертным ассистентом, способным справляться с самыми сложными запросами пользователей.
Развитие рассуждающей модели
Ваша главная задача — учить самую сильную рассуждающую модель. Вы будете собирать и поддерживать наши агентские пайплайны генерации данных для RL, чтобы развивать новые способности Алисы, а также стабилизировать RL-обучение модели на масштабе траекторий из сотен вызовов тулов. Кроме того, предстоит разбираться, где, как и почему модель ошибается на тяжёлых фактовых запросах, и превращать эти инсайты в успешные сигналы для обучения.
Поиск новых направлений
Исследования LLM — активно развивающаяся область с постоянно появляющимися моделями, статьями и направлениями. В нашей работе важно уметь выделять хорошо масштабирующиеся подходы, которые помогут нам достигать целей. Вы будете экспериментировать с самыми перспективными и свежими идеями.
Руководство командой исследователей
Вы возглавите команду senior-исследователей: нужно будет ставить смелые цели, развивать экспертность и научную культуру, налаживать взаимодействие с командами DL, аналитики и инфраструктуры. Ещё одна важная задача — находить и нанимать лучших специалистов, ведь проекты становятся всё сложнее и масштабнее.
Больше об ML в Яндексе — в канале Yandex for ML