Яндекс

SRE в Yandex Cloud Managed Kubernetes

Санкт-Петербургoffice

О компании

Яндекс — IT-компания из России, которая развивает продукты и сервисы в разных направлениях: от интернет-сервисов до облачных решений. В контексте вакансии ключевой фокус связан с инфраструктурой и эксплуатацией облачных платформ, где требуются надежные практики SRE и эксплуатации контейнерных сред.

Ключевые факты:

  • Компания: Яндекс
  • Направление роли: SRE и Kubernetes в managed cloud-подходе

О вакансии

Команда, в которой открыта роль SRE, отвечает за эксплуатацию инфраструктуры в контуре Yandex Cloud Managed Kubernetes. Это среда, где особенно важны надежность, предсказуемость работы и быстрый отклик на инциденты: платформу нужно держать в стабильном состоянии при постоянных изменениях и нагрузке.

Роль ориентирована на инженера уровня от 3 лет опыта: вы будете работать с эксплуатационными задачами, связывая принципы SRE с практикой работы с Kubernetes в managed-сценарии. Важная часть работы — обеспечивать операционное качество: чтобы сервисы работали ровно так, как ожидается, а проблемы выявлялись и устранялись системно.

В этой позиции вы будете взаимодействовать с инфраструктурными командами и участвовать в улучшениях процесса эксплуатации — от диагностики до предотвращения повторения инцидентов, в логике SRE.

Чем предстоит заниматься:

  • Обеспечивать надежную работу окружений на базе Yandex Cloud Managed Kubernetes
  • Участвовать в реагировании на инциденты и разборе причин с фокусом на устойчивость
  • Помогать поддерживать доступность и производительность сервисов в Kubernetes
  • Вести диагностику проблем в кластерах и вокруг инфраструктуры
  • Содействовать улучшениям эксплуатационных процессов и инженерных практик

Что мы предлагаем:

  • Работа в компании Яндекс
  • Социальные гарантии и IT-формат занятости (как указано в описании)

Обязанности

  • Поддерживать стабильность платформы в рамках Yandex Cloud Managed Kubernetes
  • Участвовать в реагировании на инциденты и восстановлении работоспособности
  • Проводить диагностику проблем, связанных с работой Kubernetes-среды
  • Участвовать в разборе причин инцидентов и выработке мер против повторов
  • Помогать обеспечивать доступность и корректную работу сервисов в кластере
  • Содействовать улучшениям процессов эксплуатации и операционных практик

Похожие вакансии

Как получить эту работу — с ИИ-помощником РаботаМакс

Бесплатно поможем на каждом шаге. Нажмите, чтобы раскрыть.