К списку

Руководитель группы рассуждений Alice AI LLM

Яндекс

ГибридМосква seniorОбщие сервисы ЯндексаML-разработчик

Наша команда развивает продвинутые способности Alice AI LLM, обучая наши модели решать самые нетривиальные задачи.

Мы обучаем единую рассуждающую модель Alice AI, которая объединяет в себе модальности, рассуждения и использование тулов. Фокусируемся на сценариях, где требуется сложный ризонинг, написание качественного кода и уверенное использование инструментов, таких как CodeSandbox и поиск.

Наша ключевая цель — сделать Алису экспертным ассистентом, способным справляться с самыми сложными запросами пользователей.

Какие задачи вас ждут

Развитие рассуждающей модели
Ваша главная задача — учить самую сильную рассуждающую модель. Вы будете собирать и поддерживать наши агентские пайплайны генерации данных для RL, чтобы развивать новые способности Алисы, а также стабилизировать RL-обучение модели на масштабе траекторий из сотен вызовов тулов. Кроме того, предстоит разбираться, где, как и почему модель ошибается на тяжёлых фактовых запросах, и превращать эти инсайты в успешные сигналы для обучения.

Поиск новых направлений
Исследования LLM — активно развивающаяся область с постоянно появляющимися моделями, статьями и направлениями. В нашей работе важно уметь выделять хорошо масштабирующиеся подходы, которые помогут нам достигать целей. Вы будете экспериментировать с самыми перспективными и свежими идеями.

Руководство командой исследователей
Вы возглавите команду senior-исследователей: нужно будет ставить смелые цели, развивать экспертность и научную культуру, налаживать взаимодействие с командами DL, аналитики и инфраструктуры. Ещё одна важная задача — находить и нанимать лучших специалистов, ведь проекты становятся всё сложнее и масштабнее.

Больше об ML в Яндексе — в канале Yandex for ML

Мы ждём, что вы

  • Руководили командой LLM или хотите расти в этом направлении
  • Хорошо разбираетесь в LLM и имеете опыт работы с NLP или DL
  • Умеете формулировать гипотезы и выстраивать эксперименты для их проверки
  • Готовы работать с неопределённостью и выбирать самое важное направление

Будет плюсом, если вы

  • Занимались файнтюнингом или RL больших языковых моделей
  • Работали в среде, требующей глубокого ресёрча (например, в AI или quantitative research)
  • Собирали сложные бенчмарки для языковых моделей
  • Публиковали статьи на тему языковых моделей или RL

Источник: yandex.ru (Яндекс) 29 августа 2026