Senior DevOps / MLOps Specialist

По договоренности

  • Динамо
  • Площадь 1905 года
  • Геологическая

Мы развиваем команду Больших языковых моделей и машинного обучения и ищем сильного Senior DevOps / MLOps, которому интересно не просто поддерживать существующую инфраструктуру, а создавать сложную распределённую систему с нуля.

Сейчас мы создаём собственную платформу распределённых вычислений, которая позволит объединить большое количество вычислительных ресурсов — CPU, GPU и другие мощности — в единую систему.

Стек: Linux, Nomad, Kubernetes, Docker, Docker Registry, CI/CD, Monitoring, Ray, GPU, ML infrastructure.

Чем предстоит заниматься:

  • Проектировать и развивать архитектуру распределённой вычислительной платформы
  • Объединять различные вычислительные ресурсы в единую систему
  • Работать с большими CPU/GPU-кластерами
  • Автоматизировать распределение вычислительных задач
  • Разворачивать и поддерживать инфраструктуру для ML-нагрузок
  • Обеспечивать стабильность и масштабируемость production-системы
  • Работать с контейнеризацией и оркестрацией
  • Развивать CI/CD и мониторинг
  • Взаимодействовать с ML-разработчиками и командой R&D.
Это не классический DevOps-проект, где основная задача — поддерживать уже существующую инфраструктуру. Здесь предстоит много проектировать, экспериментировать, принимать архитектурные решения и строить систему с нуля.

Мы ищем специалиста, который:

  • Имеет 4–5+ лет опыта в DevOps / MLOps
  • Работал с распределёнными вычислительными системами
  • Имеет реальный опыт работы с большими production-кластерами
  • Понимает особенности GPU-инфраструктуры
  • Понимает, как устроен процесс обучения нейронных сетей и распределённого обучения
  • Умеет работать с Kubernetes и/или Nomad
  • Уверенно работает с Docker и Docker Registry
  • Имеет опыт построения и развития инфраструктуры с нуля, а не только её поддержки
  • Понимает, как обеспечить надёжность, масштабируемость и производительность распределённой системы.

Будет большим плюсом:

  • Опыт работы в крупном технологическом проекте;
  • Опыт работы с GPU-фермами, суперкомпьютерами или крупными вычислительными кластерами;
  • Опыт с внутренними ML-платформами;
  • Опыт работы с Ray;
  • Опыт построения распределённых вычислительных систем.

Что предлагаем:

  • Возможность работать со сложной и масштабной инфраструктурой
  • Высокая степень влияния на технические решения и развитие направления
  • Современный стек и архитектурная свобода
  • Просторный офис в Екатеринбурге с кофейней
  • Гибрид 50/50 (офис Восточная 7Г + удалёнка)
  • Спортивные активности, корпоративы
  • Карьерный рост и обучение.

Адрес: Россия, Екатеринбург, Восточная улица, 7Г
Показать на большой карте

Поделиться:

Опубликована 14 дней назад

Похожие вакансии

Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно
Компания ТрансАтлантик – ведущий логистический оператор, специализирующийся на международных перевозках различными видами сухопутного, водного и воздушного транспорта. Сложившаяся ситуация в стране и мире дала дополнительные возможности для компаний,...
  • Полный день
  • Опыт от 5 лет
Логотип компании ТрансАтлантикТрансАтлантик
  • Екатеринбург
3 дня назад
от 100 000 ₽
Рыночная зарплата
Для нас важно: - опыт работы в инфраструктуре, системном администрировании или DevOps от 7 лет; - опыт ... Будет преимуществом, если вы работали с: Asterisk Kubernetes и Docker; IaC и GitOps; DevOps- и SRE-практиками ...
  • Полный день
  • Опыт от 5 лет
Логотип компании Avtobus1.ruAvtobus1.ru
  • Екатеринбург
4 дня назад
... компаниях руководителем внутренних или внешних коммуникаций либо не в руководящей позиции дошли до уровня senior ...
  • Полный день
  • Опыт от 5 лет
Логотип компании КонтурКонтур
  • Екатеринбург
4 дня назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.