Senior DevOps engineer / SRE engineer (highload)
По договоренности
Вам предстоит:
- Проектировать и реализовывать архитектуру инфраструктуры продукта: обеспечивать высокую доступность (HA), отказоустойчивость по зонам, проводить capacity planning;
- Разбирать сложные кросс-системные инциденты на стыке Kubernetes, баз данных, сетей и приложений. Доводить их до root cause, фиксировать результаты в постмортемах;
- Развивать IaC: поддерживать Ansible-инвентарь для provisioning VM и конфигурации кластеров БД/брокеров, автоматизировать ручные процессы эксплуатации;
- Эксплуатировать и развивать кластеры данных: PostgreSQL/Patroni (включая шардирование), Kafka, Redis Cluster, OpenSearch, MongoDB. Участвовать в R&D миграции хранилища сообщений на ScyllaDB;
- Развивать CI/CD-процесс совместно с инженером CI: внедрять trunk-based development, автопромоушен, стратегии canary- и blue-green-релизов;
- Строить мониторинг и модели здоровья системы: определять ключевые метрики, настраивать алертинг и SLO-пробы.
- Имеете 5+ лет опыта эксплуатации highload-продакшена в роли SRE, DevOps или инфраструктурного инженера;
- Глубоко траблшутите Kubernetes в проде: понимаете сеть, ingress, распределение ресурсов и отказоустойчивость (не ограничиваетесь только деплоем), уверенно работаете с Helm;
- Уверенно эксплуатируете базы данных: обязательно PostgreSQL (репликация, failover/Patroni, бэкапы, восстановление, тюнинг производительности) плюс минимум одну из систем: Kafka, Redis Cluster, OpenSearch/Elasticsearch, Cassandra/ScyllaDB;
- Владеете IaC на уровне Ansible (роли, инвентари) или готовы перейти на него; глубоко знаете Linux-администрирование (systemd, сеть, дисковая подсистема);
- Настраиваете CI/CD: имеете опыт с GitLab CI или аналогами, понимаете trunk-based development и progressive delivery (canary-релизы);
- Строите наблюдаемость «от модели здоровья»: владеете Prometheus/PromQL, настраиваете алертинг и трейсинг, умеете проектировать мониторинг под бизнес-логику сервиса, а не просто собирать готовые дашборды;
- Управляете инцидентами: несете on-call, приоритизируете задачи во время сбоев и пишете качественные постмортемы;
- Обладаете самостоятельностью: способны взять направление целиком и вести его без микроменеджмента.
Опубликована 2 дня назад
Похожие вакансии
Вакансии быстро закрываются — подпишитесь на наш канал в MAX сейчас, чтобы видеть их первыми.
Подписаться в MAXМы приглашаем DevOps/GitOps инженера присоединиться к нашей команде Требования: Kubernetes на практике ...
- Можно удаленно
- Полный день
- Опыт от 5 лет
- Москва
день назад
... позволяет получать сотни услуг и сервисов в удобном цифровом формате в режиме 24/7 Формируем команду Devops ... отказоустойчивости и производительности консультирование разработчиков по вопросам инфраструктуры и DevOps-практик ... Требования: практический опыт работы на позиции Devops/SRE не менеe 5 лет глубокие знания и практический ...
- Можно удаленно
- Полный день
- Опыт от 5 лет
- Москва
4 дня назад
300 000 - 420 000 ₽
Выше средней на 20%
Компания Clearway Integration – команда архитекторов и консультантов, созданная выходцами из Microsoft Consulting Services. Мы создаем программные продукты для управления и мониторинга больших ИТ-инфраструктур. Компания аккредитована в реестре Минциф...
- Можно удаленно
- Полный день
- Опыт от 5 лет
- Москва
9 дней назад
... программного обеспечения для игорного бизнеса, сотрудничающую с ведущими мировыми провайдерами мы ищем Senior ... DevOps инженера для развития и поддержки инфраструктуры. ... Требования: Опыт работы DevOps Engineer от 5 лет.
- Можно удаленно
- Полный день
- Опыт от 5 лет
- Москва
10 дней назад
Мы ищем опытного и увлеченного DevOps инженера в нашу небольшую, но дружную команду инфраструктуры! ... Что для нас важно Мы ищем сильного senior-специалиста с опытом реальной production-нагрузки. ... Ожидаем от тебя: от 6 лет опыта в инфраструктуре; 5+ лет в роли DevOps / SRE / Infrastructure Engineer ...
- Можно удаленно
- Полный день
- Опыт от 5 лет
- Москва
14 дней назад
Вакансия в подборках
Похожие вакансии
300 000 - 420 000 ₽