SRE / DevOps Engineer (Agentic AI)
По договоренности
Мы команда Департамента Глобальных Рынков Сбера, где создаются системы для трейдинга. Сейчас мы развиваем два high-load направления: сбор и дистрибуцию потоковых маркет-данных, а также расчет позиций и рисков в реальном времени.
Сейчас команда создает AIOps-систему. Мы не просто внедряем мониторинг, мы строим ИИ-агента, который способен автономно наблюдать за сервисами, находить первопричины инцидентов и устранять их. Мы фанаты автоматизации и ищем того, кто разделит этот подход.
Мы ищем SRE-инженера, который готов заниматься задачами на стыке R&D и реальной эксплуатации.
Что ты будешь делать:
- развивать и сопровождать AI-агента для автоматического обнаружения, диагностики и устранения инцидентов в критичных системах
- проектировать слой наблюдаемости (метрики, логи, трейсинг) как фундамент для работы AI-агента. Настраивать умный алертинг, корреляцию и группировку событий
- разрабатывать и отлаживать tools и playbooks, которыми агент пользуется для диагностики и устранения проблем
- разбирать инциденты (postmortem) и ошибки агента (ложные срабатывания), на основе анализа повышать точность и полноту автоматического реагирования
- наполнять и структурировать базу знаний агента (историю инцидентов, документацию), внедрять RAG для улучшения качества автоматических решений
- работать с инфраструктурным стеком компании: k8s, Istio, Nginx, haproxy, Kafka, Ignite, PostgreSQL, Hashicorp Vault, Nexus, ELK
- поддерживать и оптимизировать CI/CD-конвейеры нескольких команд
- работать с R&D задачами различной сложности.
Мы ожидаем, что ты имеешь:
- высшее образование в сфере IT
- опыт построения систем мониторинга: логирование (ELK), метрики (Prometheus/Grafana), трейсинг
- готовность к активной коммуникации с другими командами подразделения
- опыт работы с Ansible, Istio, Hashicorp Vault
- опыт построения CI/CD: Jenkins, ArgoCD и т.д.
- опыт с Git
- опыт администрирования Linux: Debian/Ubuntu
- понимание принципов балансировки нагрузки и опыт конфигурации Nginx.
Будет плюсом:
- опыт настройки, администрирования Apache Ignite и Apache Kafka
- навыки сборки приложений: Maven, npm
- опыт работы с PostgreSQL
- опыт развертывания Kubernetes с нуля, написания Helm-чартов
- опыт использования AI-агентов для решения инфраструктурных задач и автоматизации.
Работа в Сбере – это:
- современный офис на Вавилова, 19 с собственным паркингом, столовой, кафетериями, зонами отдыха и спортзалом
- ежегодный пересмотр зарплаты и годовая премия
- более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
- программа адаптации и помощь наставника на старте
- расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
- льготная ипотека и кредитование от Сбера
- бесплатная подписка СберПрайм+, скидки на продукты компаний-партнеров.
Адрес: Россия, Москва, улица Вавилова, 19
Опубликована 14 дней назад
Похожие вакансии
Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно... доставки Участвовать во внедрении базовых мер информационной безопасности Что важно для нас: Опыт работы DevOps-инженером ...
- Полный день
- Опыт от 3 лет
- Москва
6 дней назад
... на разработке программного обеспечения для моделирования месторождений нефти и газа требуется Cloud DevOps ... Engineer.
- Полный день
- Опыт от 3 лет
- Москва
3 дня назад
Мы ищем в нашу дружную команду Senior DevOps engineer Обязанности: Реализация концепции IaC; Оптимизация ...
- Полный день
- Опыт от 3 лет
- Москва
4 дня назад
Нам нужен опытный DevOps-инженер, который сможет построить и автоматизировать всю инфраструктуру: от ... Что для нас важно: опыт от 5 лет в DevOps/SRE/Infrastructure глубокие знания Linux, сетей, безопасности ...
- Полный день
- Опыт от 3 лет
- Москва
4 дня назад
... обеспечивать высокую доступность масштабируемости и отказоустойчивости сервисов внедрять и развивать практик DevOps ... интеграция с экосистемой Hadoop bash: написание сложных скриптов для автоматизации задач администрирования и DevOps-процессов ...
- Полный день
- Опыт от 3 лет
- Москва
17 дней назад
Миссия роли: возглавить команду (3 человека), которая выстраивает процесс IaС (в том числе встраивание в текущий релизный/производственный процессы департамента) , вазвивает инструменты по управлению инфраструктурой CLI/UI , поддерживает продуктовые ...
- Полный день
- Опыт от 3 лет
- Москва
7 дней назад