АО ТМГТ

Senior SRE / Platform Engineer (AWS / Kubernetes)

Москва, Киевская, Студенческая, Саввинская набережнаяПолная занятость3–6 лет

Загрузи резюме, чтобы повысить шансы пройти на вакансию «Senior SRE / Platform Engineer (AWS / Kubernetes)»Разберём резюме ИИ и покажем, что доработать — здесь же, не уходя со страницы

О компании

АО ТМГТ — это высокотехнологичная компания, занимающаяся разработкой и внедрением инновационных решений в области финансов и блокчейна. Мы создаем надежную инфраструктуру, на которую могут полагаться как наши клиенты, так и бизнес-партнеры. Наша команда фокусируется на безопасности и высоких стандартах надежности, что делает нас одним из лидеров на рынке.

Ключевые факты:

  • Год основания: 2010
  • Местоположение офисов: Москва, Киевская, Студенческая, Саввинская набережная
  • Основные продукты: облачные решения, блокчейн-технологии
  • Размер команды: более 100 специалистов
  • Основные направления: финтех, блокчейн, облачные технологии

О вакансии

Мы формируем команду инженеров, специализирующихся на SRE и платформенных решения, которым предстоит ответственная задача в области обеспечения надежности и безопасности финансовых систем. Ваша работа будет связана с инцидент-менеджментом, CI/CD и эксплуатацией блокчейн-нод, а также с развитием внутренней инфраструктуры, что позволяет нам оставаться на передовой технологической линии.

Вы займетесь созданием и внедрением SLO/SLI, где будете управлять всеми аспектами мониторинга и управлением инцидентами. Также вы обеспечите высокую доступность облачной инфраструктуры, отвечая за отказоустойчивость и масштабирование, что критически важно для систем, обрабатывающих денежные средства.

Чем предстоит заниматься:

  • Определять и внедрять SLO/SLI, error budgets и системы алертинга на их основе.
  • Развивать CI/CD и инфраструктуру как код с использованием Terraform или его аналогов.
  • Эксплуатировать облачную инфраструктуру AWS, управляя отказоустойчивостью и стоимостью.
  • Обеспечивать мониторинг и обновление блокчейн-нод и валидаторов, контролируя их синхронизацию.
  • Участвовать в инцидент-менеджменте, включая он-колл ротации и анализ постмортемов.
  • Создавать инструменты для внутренняя самообслуживания и поддержки разработчиков.

Что мы предлагаем:

  • Возможность влиять на архитектуру и процессы компании.
  • Работа в небольшой команде, где каждое мнение имеет значение.
  • Высокие требования к технической глубине и надежности продуктов.
Навыки
SREDevOpsPlatform EngineeringAWSKubernetesTerraformCI/CDInfrastructure as CodePrometheusGrafanaOpenTelemetryIncident ManagementSLOLinuxPython

Обязанности

  • Определение и реализация SLO/SLI, error budgets и алертинга.
  • Создание и оптимизация CI/CD, инфраструктуры как код.
  • Обеспечение высокой доступности облачной инфраструктуры AWS.
  • Мониторинг и управление блокчейн-нодами и валидаторами.
  • Ведение инцидент-менеджмента и проведение постмортемов.
  • Разработка инструментов и процессов для поддержки разработчиков.

Условия

  • Работа над продуктом с высокой технической глубиной.
  • Влияние на архитектурные решения и процессы.
  • Минимум бюрократии и быстрая реакция на решения.

Похожие вакансии

Как получить эту работу — с ИИ-помощником РаботаМакс

Бесплатно поможем на каждом шаге. Нажмите, чтобы раскрыть.