БЮРО 1440

Старший backend-инженер вычислительной платформы

Москва, Мнёвники, Большая кольцевая линия, метро МнёвникиУдалённоПолная занятость3–6 лет

О компании

БЮРО 1440 — аккредитованная ИТ-компания из Москвы, которая связана с тематикой освоения космоса и ориентирована на технологические разработки для вычислительных и производственных сценариев.

Ключевые факты:

  • Аккредитованная ИТ-компания
  • Линейка задач связана с вычислительной платформой и интеграцией HPC-сценариев
  • Форматы работы: офис/гибрид/удаленно (на выбор)
  • Офис в Москве рядом с метро

О вакансии

Старший backend-инженер вычислительной платформы будет усиливать команду, которая строит серверную часть для запуска, управления и мониторинга вычислительных задач. Фактически вы участвуете в создании “мозгов” платформы, которая связывает пользовательские запросы, вычислительные очереди и инфраструктуру хранения.

Внутри направления важны интеграции с HPC-экосистемой: платформа должна уметь отправлять задания в Slurm, вести их lifecycle (от submit до статусов, логов, отмены и обработки ошибок), а также готовить спецификации вычислительных задач из высокоуровневых команд пользователя.

Отдельный пласт — инженерия данных и производственные пайплайны: работа с PostgreSQL, S3/файловыми хранилищами, асинхронными механизмами обмена, а также разработка API и tooling (CLI, Python SDK) для интеграции с внешними системами и интерактивными сценариями (в том числе Jupyter).

Чем предстоит усилить архитектуру роли:

  • Проектировать и развивать backend-сервисы, в первую очередь на Go
  • Строить и поддерживать REST API для управления вычислительными заданиями
  • Реализовывать интеграции с Slurm и вести жизненный цикл задач
  • Делать трансляцию пользовательских запросов в спецификации вычислений
  • Интегрировать платформу с реестром моделей и контейнеров
  • Развивать хранилища и связку с S3
  • Участвовать в создании компонентов планирования/ресурсного учета: квоты, accounting и политики
  • Работать с асинхронным взаимодействием (Kafka или аналоги там, где требуется)
  • Разрабатывать CLI и Python SDK для работы с платформой
  • Участвовать в code review, архитектурных решениях и разборе production-инцидентов вместе с HPC- и SRE-инженерами

Что мы предлагаем:

  • Аккредитованная ИТ-компания
  • Оформление по ТК РФ
  • Возможность выбрать формат работы: офис/гибрид/удаленно
  • Современный офис в Москве рядом с метро
  • Совместная культура техрешений: разбор production-проблем вместе с HPC и SRE
Навыки
GolangPostgreSQLSQLLinuxDockerSlurm

Обязанности

  • Разрабатывать backend-сервисы на Go для вычислительной платформы
  • Создавать API для запуска, управления и мониторинга вычислительных задач
  • Интегрировать платформу с Slurm и обеспечивать корректный lifecycle заданий
  • Реализовать стадии submit, queue, run, status, logs, cancel, failure handling и получение результатов
  • Преобразовывать запросы пользователя в спецификацию вычислительной задачи
  • Интегрировать платформу с реестром моделей и контейнеров
  • Проектировать работу с S3 и файловыми хранилищами
  • Разрабатывать модули квот, accounting и политик использования ресурсов
  • Использовать Kafka или другие подходящие механизмы асинхронного взаимодействия для нужд платформы
  • Разрабатывать CLI и Python SDK для интеграций и удобного доступа к функциональности платформы
  • Участвовать в развитии Jupyter и интерактивных вычислительных сценариев
  • В дальнейшем развивать API для интеграции HPC-вычислений в production-пайплайны компании
  • Писать интеграционные и end-to-end тесты
  • Участвовать в code review и в архитектурных решениях
  • Совместно с HPC- и SRE-инженерами разбирать проблемы в production

Условия

  • Аккредитованная ИТ-компания
  • Оформление по ТК РФ
  • Формат работы на выбор: офис/гибрид/удаленно
  • Комфортный современный офис в Москве рядом с метро
  • Взаимодействие с HPC- и SRE-инженерами при разборе production-проблем

Похожие вакансии

Как получить эту работу — с ИИ-помощником РаботаМакс

Бесплатно поможем на каждом шаге. Нажмите, чтобы раскрыть.