Яндекс

Аналитик-разработчик в команду LLM-судей для Alice AI

Москваoffice

Загрузи резюме, чтобы повысить шансы пройти на вакансию «Аналитик-разработчик в команду LLM-судей для Alice AI»Разберём резюме ИИ и покажем, что доработать — здесь же, не уходя со страницы

О компании

Яндекс — российская IT-компания с продуктовыми и инфраструктурными направлениями, где команды решают прикладные задачи на стыке данных, машинного обучения и инженерии. Внутри компании развиваются сервисы, которые масштабируются на миллионы пользователей, а также создаются внутренние платформы для разработки и аналитики.

Немного о нас в цифрах:

  • Компания: Яндекс

О вакансии

Команда LLM-судей для Alice AI помогает улучшать качество работы голосового ассистента: оценивает ответы моделей, выстраивает критерии качества и поддерживает процессы, которые позволяют системе становиться точнее и надежнее.

В роли аналитика-разработчика вы будете работать на границе аналитики и инженерной реализации: формулировать метрики, превращать результаты исследований в воспроизводимые проверки и участвовать в развитии контуров оценки для LLM.

Вы будете тесно взаимодействовать с разработчиками и теми, кто занимается качеством моделей и продуктовой логикой Alice AI, чтобы решения основывались на данных, а итерации приносили измеримый эффект.

Чем предстоит заниматься:

  • Проектировать и поддерживать подходы к оценке качества ответов LLM в контуре LLM-судей
  • Анализировать результаты прогонов и находить причины просадок качества
  • Формализовать критерии качества и переводить их в проверяемые сценарии
  • Участвовать в подготовке данных и разметке/сопровождении датасетов для оценки (если потребуется в рамках процесса)
  • Разрабатывать и улучшать инструменты/скрипты для автоматизации оценок
  • Собирать метрики качества и помогать интерпретировать их для команды
  • Поддерживать воспроизводимость оценок: фиксировать версии, условия и параметры прогонов

Что мы предлагаем:

  • Работа в Яндекс в команде, связанной с улучшением Alice AI
  • Социальные гарантии и высокий уровень компенсаций в IT-компании России

Обязанности

  • Проработка и развитие подходов к оценке качества ответов LLM в контуре LLM-судей
  • Анализ результатов прогона моделей и выявление факторов, влияющих на качество
  • Формализация критериев качества и перевод их в практические проверки
  • Разработка/улучшение инструментов для автоматизации оценок и сборки метрик
  • Поддержка воспроизводимости экспериментов и условий прогона
  • Подготовка и сопровождение данных для оценочных сценариев (в рамках процесса команды)
  • Интерпретация метрик и подготовка выводов для улучшений Alice AI
  • Участие в итерациях качества вместе с разработчиками и смежными ролями

Условия

  • Локация: Москва
  • Формат работы: не указан
  • Опыт: от 3 лет
  • Компенсация: высокий уровень заработной платы
  • Социальные гарантии: указаны

Похожие вакансии

Как получить эту работу — с ИИ-помощником РаботаМакс

Бесплатно поможем на каждом шаге. Нажмите, чтобы раскрыть.