🤖 ML-разработчик в группу рассуждений Alice AI
Наша команда развивает продвинутые способности Alice AI LLM, обучая наши модели решать самые нетривиальные задачи. Наша ключевая цель — сделать Алису экспертным ассистентом, способным справляться с самыми сложными запросами пользователей.
Какие задачи вас ждут:
• Развитие рассуждающей модели Ваша главная задача — учить одну из самых сильных рассуждающих моделей. Возможные задачи: сбор и поддержка пайплайнов генерации сред для RL для новых способностей Алисы; стабилизация RL-обучения нашей рассуждающей модели; разбор ситуаций, где, как и почему модель ошибается на тяжёлых фактовых запросах.
• Обучение моделей и анализ экспериментов Предстоит работать в RnD-цикле экспериментов над элайнментом рассуждающих моделей. Нужно будет взаимодействовать с аналитиками для построения стабильных замеров и искать точки роста инфраструктуры.
• Поиск новых направлений В нашей работе важно уметь выделять хорошо масштабирующиеся подходы, которые помогут достичь наших целей. Вы будете экспериментировать с самыми перспективными и свежими идеями.
Мы ждём, что вы: • Уверенно программируете на Python и внедряли в продакшен исследовательские пайплайны • Хорошо разбираетесь в LLM и имеете опыт работы в NLP/DL • Умеете формулировать гипотезы и выстраивать эксперименты для их проверки • Готовы работать с неопределённостью и выбирать самое важное направление
Будет плюсом, если вы: • Занимались файн-тюнингом или RL больших языковых моделей • Работали в среде, требующей глубокого ресёрча (например, в AI или quantitative research) • Собирали сложные бенчмарки для языковых моделей • Публиковали статьи на тему языковых моделей и/или RL
Почему у нас классно: Сотрудники Яндекса бесплатно участвуют в профильных конференциях. А для тех, кто на них выступает, у нас есть школа подготовки спикеров. Это не все бонусы — полный список тут.
📩 Откликайтесь на вакансию на нашем сайте