Senior Big Data Engineer (Data Platform)

По договоренности

  • Крылатское
  • Мнёвники

Чем предстоит заниматься:

  • Разрабатывать и совершенствовать лучшую на рынке платформу данных электронной коммерции нового поколения;
  • Проектировать и разрабатывать ETL пайплайны на Airflow для Spark (Batch, Streaming), Iceberg, Trino;
  • Оптимизировать действующие пайплайны и джобы на Spark - мониторить нагрузку на кластер и оптимальность затрачиваемых джобами ресурсов и если необходимо оптимизировать;
  • Взаимодействовать с аналитиками и ML специалистами для создания/развертывания инструментов и наборов данных, соответствующих их вариантам использования - поддерживать регулярные связи с data ops для развития дата-платформы;
  • Анализировать и внедрять инструменты инжиниринга данных (Lineage, DQ);
  • Проектировать хранилища данных на основе k8s, настраивать производительность, мониторинг, планировать емкости кластера и другой инфраструктуры - думать над тем что и как грузить и в каких партициях;
  • Решать задачи, связанные с внедрением облачной инфраструктуры - разрабатывать новую архитектуру хранилища
  • Проводить code review и принимать участие в архитектурных решениях по дата платформе в команде.

Мы ожидаем:

  • Kubernetes - понимание ресурсной модели, просмотр конфигураций, troubleshooting.
  • Опыт работы с Hadoop (HDFS, Hive Metastore)
  • Опыт работы со Spark (spark SQL, streaming, понимание ньюансов работы с pyspark);
  • Apache Icberg – владение процедурами, snapshots, maintenance
  • Глубокое понимание Airflow (2, 3) – идемпотентность, assets, backfills
  • Уверенное знание Git, CI/CD;
  • Python, Scala/Java – ООП, проектирование библиотек, интеграционные/юнит тесты;
  • Хорошее понимание СУБД, SQL;

Будет плюсом:

  • Опыт работы с Docker (уверенное владение для поднятия локального окружения проекта);
  • Опыт работы с Kafka – понимание архитектуры и слабых мест;
  • Опыт с облачными технологиями: преимущественно Yandex Cloud;
  • Опыт с Clickhouse.
  • AI-native подход к разработке: активное использование Claude Code / Codex и подобных инструментов, опыт построения harness-систем — агентов с инструментами, автоматизации через LLM, RAG.

Адрес: Россия, Москва, Крылатская улица, 15
Показать на большой карте

Поделиться:

Опубликована 2 часа назад

Похожие вакансии

Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно
... Data, ML и многом другом. ... Предлагаем присоединиться в роли DevOps Engineer и работать над проектом заказчика. ... Engineering и инфраструктуры; сопровождать Big Data Platform.
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании AstonAston
  • Москва
2 часа назад
Ищем Data Engineer в команду Big Data Platform. ... Опыт работы с DataHub или другими Data Catalog решениями. ... Опыт построения мониторинга data-платформ и пайплайнов.
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании Детский мирДетский мир
  • Москва
день назад
... Engineer или разработчиком от 3 лет, из них не менее 2 лет в области потоковой обработки данных (Apache ... Flink, Kafka Streams, Spark Streaming) или Big Data Уверенное знание Java (или Scala) и опыт разработки ... Знание экосистемы Hadoop/Big Data: HDFS, HBase, Hive.
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании Лига Цифровой ЭкономикиЛига Цифровой Экономики
  • Москва
16 дней назад
... более 30 миллионов услуг в режиме умного диалога Сейчас мы находимся в поиске креативного и сильного AI Engineer ... успешных ИИ проектов на портале Мы ждём, что ты имеешь Опыт и самостоятельность: Подтвержденный опыт в Data ... FastAPI, Docker), но минимальное требование - умение и желание писать prod-like код, в остальном поможем Big ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании РТЛабсРТЛабс
  • Москва
день назад
Ищем Data Engineer / Backend специалиста для разработки и развития высоконагруженных систем антифрод-скоринга ... Вы будете работать на стыке Data Engineering, Backend и Machine Learning: развивать микросервисы и data ... Технологический стек: Big Data: Spark, Hadoop, S3, Iceberg, Airflow; Backend: Python, FastAPI, Flask, ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании Альфа-БанкАльфа-Банк
  • Москва
месяц назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.