Alice AI помогает пользователям решать самые разные задачи: искать информацию, разбираться в сложных вопросах и работать с внешними инструментами. За то, как модель ведёт диалог, рассуждает и следует инструкциям, отвечает команда алайнмента.
Одно из направлений команды — системные промпты и управляемость модели. Системный промпт задаёт роль, стиль, формат ответа и правила работы с инструментами. При изменении инструкций модель должна предсказуемо менять поведение, сохраняя общее качество ответов.
Мы ищем руководителя, который задаст техническое направление этой работы и поможет команде превращать исследовательские гипотезы в решения для релизной модели.
Техническое развитие направления
Вы будете формировать технический курс вместе с командой, руководителем и продуктовыми партнёрами, выбирать ключевые гипотезы и принимать решения по результатам экспериментов.
Обучение и управляемость модели
Вам предстоит развивать методы обучения, данные и reward-модели, которые помогают Alice AI следовать системным инструкциям. Работа включает постановку воспроизводимых экспериментов, анализ поведения модели и развитие следующей итерации решения.
Оценка качества
Оценку качества системных промптов разрабатывает команда аналитики. Вы будете активно взаимодействовать с ней: помогать формулировать требования к оценке, следить за её качеством и проверять, насколько надёжно она отражает изменения в поведении модели.
Интеграция результатов
Вы будете доводить подтверждённые экспериментами решения до релизной модели, согласовывать технические изменения с командами RL, интеграции и оценки качества и участвовать в разборе сложных проблем на стыке направлений.
Техническая работа с командой
Вы будете вместе с командой исследовать актуальные подходы к управляемости языковых моделей, определять, какие из них подходят для наших задач, и проектировать решения для проверки на Alice AI.
Больше об ML в Яндексе — в канале Yandex for ML