Яндекс — один из крупнейших IT-компаний России, занимающийся разработкой технологий и решений в области интернет-сервисов. Компания активно работает над проектами в области искусственного интеллекта, включая разработку больших языковых моделей (LLM) и оптимизацию их инфраструктуры. Яндекс осуществляет полный цикл разработки и внедрения своих технологии, обеспечивая высокую доступность и качество предоставляемых услуг.
Ключевые факты:
Команда, занимающаяся LLM в Яндексе, решает сложные задачи, связанные с производительностью и доступностью сервисов инференса. Основное внимание уделяется разработке и оптимизации инфраструктуры, чтобы гарантировать эффективность работы больших языковых моделей. Основные задачи включают минимизацию задержек и создание надежных систем, способных обрабатывать большие объемы данных.
Ваша роль будет заключаться в оптимизации инференсных движков и упрощении процесса их диагностики. Вы будете развивать инструменты, позволяющие быстро выявлять и устранять проблемы, тем самым повышая стабильность и скорость инференса. Кроме того, вам предстоит исследовать новые методы, такие как квантование и прунинг, а также внедрять современные подходы к параллелизации.
Чем предстоит заниматься:
Что мы предлагаем:
Бесплатно поможем на каждом шаге. Нажмите, чтобы раскрыть.
Для роли «Разработчик инфраструктуры LLM» обычно разбирают опыт, профильные вопросы и кейсы. ИИ-коуч проведёт пробное интервью и даст обратную связь — заранее и без стресса.
Резюме под конкретную вакансию повышает отклик. ИИ подсветит релевантный опыт, добавит ключевые слова из требований и перепишет формулировки.
Персональное сопроводительное письмо выделяет среди откликов. ИИ напишет его под эту вакансию и подскажет, как грамотно откликнуться.