Site Reliability Engineer в группу эксплуатации YT
По договоренности
YTsaurus — опенсорс-платформа для хранения и обработки данных, которую в VK активно развивают и используют как основу единого дата-лейка. Система обрабатывает миллионы событий в секунду на динамических таблицах, работает с сотнями петабайт данных и обслуживает тысячи пользователей. У нас большие кластеры, сложная инфраструктура и высокие требования к надёжности. И мы ищем SRE, который поможет поддерживать и развивать всё это.
Задачи
- Автоматизировать эксплуатацию YTsaurus
- Интегрировать платформу с внутренними системами VK
- Следить за стабильностью и производительностью
- Разбираться с проблемами на уровне кода (в основном C++)
- Решать задачи, которые не гуглятся
- Разбираться с инцидентами в рамках дежурств
- Масштабировать кластер YTsaurus до 500ПБ
- Заниматься оптимизацией использования железа (CPU, диски)
Требования
- Опыт работы с распределёнными системами
- Знания в области сетей (TCP/IP, DNS, балансировка, ACL) и ОС Linux
- Способность работать самостоятельно: формулировать цели, предлагать решения
Будет плюсом
- Опыт работы с высоконагруженными системами или большими объёмами данных
- Владение C++ на уровне чтения и отладки сложного кода
Адрес: Россия, Москва, Садовническая улица, 82с2
Опубликована 5 дней назад
Похожие вакансии
Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатноЮзтех – группа аккредитованных ИТ-компаний полного цикла разработки с многолетней экспертизой в передовых технологиях: DWH, BigData, AI/ML, Blockchain, BI, предиктивная аналитика, цифровые двойники производства и рисков. ГК Юзтех является технологиче...
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
20 дней назад
Сейчас мы в поисках DevOps Platform Engineer. ... Мы ищем человека, у которого есть: От 4-х лет на позициях DevOps-инженера, SRE (Site Reliability Engineer ... ) или Platform Engineer; Уверенные навыки работы с Linux, системное администрирование и отладка; Уверенное ...
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
месяц назад
Сейчас наша команда Core DevOps в поисках классного DevOps Engineer (Senior), который будет обеспечивать ... mentoring) Участвовать в выработке архитектурных решений Классно, если ты Понимаешь принципы и практики Site ... Reliability Engineering Имеешь опыт построения систем Observability Работал с Grafana, Victoria Metrics ...
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
4 месяца назад
В связи с активным развитием проектов в компании открыта вакансия Data Engineer. ... Мы ищем Middle Data Engineer в команду, которая развивает наш Data Management Platform (DMP).
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
3 дня назад
Ищем QA-инженера в платформенную команду Департамента технологий корпоративного и малого бизнеса. Чем предстоит заниматься разрабатывать и поддерживать существующие автотесты на стеке: Java, Selenide, Cucumber, TestNG, Gradle, RestAssured (UI, API, M...
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
3 дня назад