Яндекс

Старший разработчик в команду ML-планера робота доставки (RL)

Санкт-Петербургoffice

О компании

Яндекс — один из крупнейших интернет-компаний в России, активно развивающаяся в области технологий и инноваций. Специализируется на предоставлении различных онлайн-сервисов, включая поисковые системы, карты, рекламу, а также разработки искусственного интеллекта и машинного обучения. Яндекс известен своим вкладом в робототехнику, в частности, в проектах доставки, где используются автономные роботы для транспортировки товаров.

Ключевые факты:

  • Один из лидеров в области интернет-технологий в России.
  • Разработка и внедрение технологий искусственного интеллекта.
  • Работа над проектами в области робототехники и доставки.

О вакансии

В команде ML-планера робота доставки вы будете заниматься разработкой моделей для планирования и прогнозирования траекторий передвижения автономных роботов. Команда активно использует опыт в области Reinforcement Learning (RL) и экспериментирует с новыми архитектурами, чтобы сделать роботов Яндекса безопаснее и эффективнее на городских улицах.

Ваша задача будет заключаться в поиске новых подходов к обучению RL-планера, а также интеграции современных методов, таких как PPO и TD-λ. Вы будете прототипировать и внедрять алгоритмы, что позволит переводить теоретические идеи в практические решения, формируя надежный продакшн-пайплайн.

Также вам предстоит работать над развитием архитектур трансформерных моделей и расширять сценарии симуляции для создания сложных условий, в которых роботы должны действовать, что поможет закрыть gap между симуляцией и реальными условиями.

Чем предстоит заниматься:

  • Поиск и интеграция новых методов обучения для RL-планера.
  • Проектирование и внедрение новых модулей в трансформерные модели.
  • Разработка и расширение сценариев симуляции для GPU-симулятора.

Что мы предлагаем:

  • Участие в передовых проектах в области ML и робототехники.
  • Доступ к мощным инструментам и ресурсам для разработки.

Обязанности

  • Исследовать и интегрировать новые подходы к обучению RL-планера.
  • Разрабатывать и прототипировать новые алгоритмы и reward-функции.
  • Проектировать и внедрять модули на базе трансформеров.
  • Обеспечивать качество и стабильность обучения моделей.
  • Создавать сложные сценарии симуляции для роботов доставки.

Похожие вакансии

Как получить эту работу — с ИИ-помощником РаботаМакс

Бесплатно поможем на каждом шаге. Нажмите, чтобы раскрыть.