Site Reliability Engineer в группу эксплуатации YT

По договоренности

  • Площадь Ильича
  • Марксистская
  • Третьяковская

YTsaurus — опенсорс-платформа для хранения и обработки данных, которую в VK активно развивают и используют как основу единого дата-лейка. Система обрабатывает миллионы событий в секунду на динамических таблицах, работает с сотнями петабайт данных и обслуживает тысячи пользователей. У нас большие кластеры, сложная инфраструктура и высокие требования к надёжности. И мы ищем SRE, который поможет поддерживать и развивать всё это.

Задачи

  • Автоматизировать эксплуатацию YTsaurus
  • Интегрировать платформу с внутренними системами VK
  • Следить за стабильностью и производительностью
  • Разбираться с проблемами на уровне кода (в основном C++)
  • Решать задачи, которые не гуглятся
  • Разбираться с инцидентами в рамках дежурств
  • Масштабировать кластер YTsaurus до 500ПБ
  • Заниматься оптимизацией использования железа (CPU, диски)

Требования

  • Опыт работы с распределёнными системами
  • Знания в области сетей (TCP/IP, DNS, балансировка, ACL) и ОС Linux
  • Способность работать самостоятельно: формулировать цели, предлагать решения

Будет плюсом

  • Опыт работы с высоконагруженными системами или большими объёмами данных
  • Владение C++ на уровне чтения и отладки сложного кода

Адрес: Россия, Москва, Садовническая улица, 82с2
Показать на большой карте

Поделиться:

Опубликована 5 дней назад

Похожие вакансии

Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно
Юзтех – группа аккредитованных ИТ-компаний полного цикла разработки с многолетней экспертизой в передовых технологиях: DWH, BigData, AI/ML, Blockchain, BI, предиктивная аналитика, цифровые двойники производства и рисков. ГК Юзтех является технологиче...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании USETECHUSETECH
  • Москва
20 дней назад
Сейчас мы в поисках DevOps Platform Engineer. ... Мы ищем человека, у которого есть: От 4-х лет на позициях DevOps-инженера, SRE (Site Reliability Engineer ... ) или Platform Engineer; Уверенные навыки работы с Linux, системное администрирование и отладка; Уверенное ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ednaedna
  • Москва
месяц назад
Сейчас наша команда Core DevOps в поисках классного DevOps Engineer (Senior), который будет обеспечивать ... mentoring) Участвовать в выработке архитектурных решений Классно, если ты Понимаешь принципы и практики Site ... Reliability Engineering Имеешь опыт построения систем Observability Работал с Grafana, Victoria Metrics ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ЮНИРЕСТЮНИРЕСТ
  • Москва
4 месяца назад
В связи с активным развитием проектов в компании открыта вакансия Data Engineer. ... Мы ищем Middle Data Engineer в команду, которая развивает наш Data Management Platform (DMP).
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ИЦ АЙ-ТЕКОИЦ АЙ-ТЕКО
  • Москва
3 дня назад
Ищем QA-инженера в платформенную команду Департамента технологий корпоративного и малого бизнеса. Чем предстоит заниматься разрабатывать и поддерживать существующие автотесты на стеке: Java, Selenide, Cucumber, TestNG, Gradle, RestAssured (UI, API, M...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании БАНК УРАЛСИББАНК УРАЛСИБ
  • Москва
3 дня назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.