Senior Big Data Engineer (Data Platform)
По договоренности
- Крылатское
- Мнёвники
Чем предстоит заниматься:
- Разрабатывать и совершенствовать лучшую на рынке платформу данных электронной коммерции нового поколения;
- Проектировать и разрабатывать ETL пайплайны на Airflow для Spark (Batch, Streaming), Iceberg, Trino;
- Оптимизировать действующие пайплайны и джобы на Spark - мониторить нагрузку на кластер и оптимальность затрачиваемых джобами ресурсов и если необходимо оптимизировать;
- Взаимодействовать с аналитиками и ML специалистами для создания/развертывания инструментов и наборов данных, соответствующих их вариантам использования - поддерживать регулярные связи с data ops для развития дата-платформы;
- Анализировать и внедрять инструменты инжиниринга данных (Lineage, DQ);
- Проектировать хранилища данных на основе k8s, настраивать производительность, мониторинг, планировать емкости кластера и другой инфраструктуры - думать над тем что и как грузить и в каких партициях;
- Решать задачи, связанные с внедрением облачной инфраструктуры - разрабатывать новую архитектуру хранилища
- Проводить code review и принимать участие в архитектурных решениях по дата платформе в команде.
Мы ожидаем:
- Kubernetes - понимание ресурсной модели, просмотр конфигураций, troubleshooting.
- Опыт работы с Hadoop (HDFS, Hive Metastore)
- Опыт работы со Spark (spark SQL, streaming, понимание ньюансов работы с pyspark);
- Apache Icberg – владение процедурами, snapshots, maintenance
- Глубокое понимание Airflow (2, 3) – идемпотентность, assets, backfills
- Уверенное знание Git, CI/CD;
- Python, Scala/Java – ООП, проектирование библиотек, интеграционные/юнит тесты;
- Хорошее понимание СУБД, SQL;
Будет плюсом:
- Опыт работы с Docker (уверенное владение для поднятия локального окружения проекта);
- Опыт работы с Kafka – понимание архитектуры и слабых мест;
- Опыт с облачными технологиями: преимущественно Yandex Cloud;
- Опыт с Clickhouse.
- AI-native подход к разработке: активное использование Claude Code / Codex и подобных инструментов, опыт построения harness-систем — агентов с инструментами, автоматизации через LLM, RAG.
Адрес: Россия, Москва, Крылатская улица, 15
Опубликована 2 часа назад
Похожие вакансии
Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно... Data, ML и многом другом. ... Предлагаем присоединиться в роли DevOps Engineer и работать над проектом заказчика. ... Engineering и инфраструктуры; сопровождать Big Data Platform.
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
2 часа назад
Ищем Data Engineer в команду Big Data Platform. ... Опыт работы с DataHub или другими Data Catalog решениями. ... Опыт построения мониторинга data-платформ и пайплайнов.
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
день назад
... Engineer или разработчиком от 3 лет, из них не менее 2 лет в области потоковой обработки данных (Apache ... Flink, Kafka Streams, Spark Streaming) или Big Data Уверенное знание Java (или Scala) и опыт разработки ... Знание экосистемы Hadoop/Big Data: HDFS, HBase, Hive.
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
16 дней назад
... более 30 миллионов услуг в режиме умного диалога Сейчас мы находимся в поиске креативного и сильного AI Engineer ... успешных ИИ проектов на портале Мы ждём, что ты имеешь Опыт и самостоятельность: Подтвержденный опыт в Data ... FastAPI, Docker), но минимальное требование - умение и желание писать prod-like код, в остальном поможем Big ...
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
день назад
Ищем Data Engineer / Backend специалиста для разработки и развития высоконагруженных систем антифрод-скоринга ... Вы будете работать на стыке Data Engineering, Backend и Machine Learning: развивать микросервисы и data ... Технологический стек: Big Data: Spark, Hadoop, S3, Iceberg, Airflow; Backend: Python, FastAPI, Flask, ...
- Можно удаленно
- Полный день
- Опыт от 3 лет
- Москва
месяц назад