Разработчик ETL

По договоренности

  • Марксистская
  • Третьяковская
  • Маяковская

Проект банка ТОП-3! Команда создает и развивает корпоративный движок потоковой обработки данных на основе Apache Flink, который используется разработчиками банка для построения приложений обработки данных в реальном времени (фрод-мониторинг, скоринг, обогащение транзакций, расчеты). Вы будете работать в команде, которая отвечает за фреймворк и платформенные возможности Flink!

Твои задачи:

  • Разрабатывать и поддерживать коннекторы для интеграции Flink с корпоративными системами хранения данных (Kafka, S3-совместимые объектные хранилища, HBase, возможно Fluss) и аналитическими СУБД

  • Реализовывать механизмы Stateful обработки: настраивать и оптимизировать State Backends (RocksDB, Heap), интегрировать с внешними хранилищами состояний для сценариев соединения с большими справочниками

  • Разрабатывать инфраструктурные решения для повышения отказоустойчивости: реализовывать механизмы checkpointing, savepoints, автоскейлинга, восстановления после сбоев, поддерживать High Availability кластеров

  • Интегрировать Flink-приложения с корпоративными системами: обеспечивать аутентификацию, работать с секрет-менеджерами, системами логирования (ELK), метриками (Prometheus/Grafana), Единым аудитом

  • Настраивать и поддерживать систему мониторинга Flink-кластеров и джобов: отслеживать метрики JVM, backpressure, checkpoint durations, consumer lag, watermarks

  • Разрабатывать и внедрять процессы управления жизненным циклом приложений (деплой, апгрейд, остановка, откат) через CI/CD и специализированный корпоративный портал управления сервисами

  • Проводить нагрузочное тестирование, анализировать узкие места производительности, оптимизировать latency и throughput потоковых конвейеров

  • Реализовывать и поддерживать Flink History Server для анализа завершенных заданий и диагностики

Что мы ждем от тебя:

  • Опыт работы Data Engineer или разработчиком от 3 лет, из них не менее 2 лет в области потоковой обработки данных (Apache Flink, Kafka Streams, Spark Streaming) или Big Data
  • Уверенное знание Java (или Scala) и опыт разработки production-ready приложений в распределенных системах
  • Практический опыт работы с Apache Flink: понимание концепций операторов, state, checkpointing, savepoints, exactly-once семантики, роли JobManager/TaskManager
  • Опыт работы с Kafka: продюсеры, консьюмеры, топологии, управление offset'ами, обработка ошибок
  • Опыт работы с системами контейнеризации и оркестрации: Docker, Kubernetes (Pods, Deployments, Services, ConfigMaps, Operators)
  • Знание принципов работы систем мониторинга: Prometheus, Grafana. Умение настраивать алерты и интерпретировать метрики
  • Продвинутый уровень SQL, опыт оптимизации запросов и работы с технической документацией (RFC, официальная docs)
  • Навыки декомпозиции сложных задач, отличные коммуникационные навыки для работы с техническими командами (разработчики, DevOps) и потребителями (data-инженеры)

Будет плюсом:

  • Опыт разработки собственных коннекторов или форматов данных для Flink.
  • Знание экосистемы Hadoop/Big Data: HDFS, HBase, Hive. Понимание принципов работы с объектными хранилищами (S3)
  • Опыт работы с системами логирования и трассировки: ELK (Elasticsearch, Logstash, Kibana), Jaeger/Zipkin
  • Понимание принципов Data Lineage и опыт интеграции с инструментами линии происхождения данных
  • Опыт работы с SQL-интерфейсами Flink (Table API/SQL) и интеграцией с корпоративными BI-системами
  • Знакомство с проектами Apache Paimon, Apache Iceberg, Fluss или аналогичными технологиями Lakehouse

Что мы обеспечиваем:

  • Внутренние семинары, митапы, мы очень любим учиться новому
  • ДМС со стоматологией для сотрудников и скидку на покупку ДМС для ближайших членов семьи
  • Технику для комфортной работы
  • Сессии профессионального развития персонала, результатом которой является план индивидуального развития каждого сотрудника

Адрес: Россия, Москва
Показать на большой карте

Поделиться:

Опубликована 13 дней назад

Похожие вакансии

Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно
... производительности, архитектуры и стандартам разработки) Исправление дефектов ПО Разработка дагов/потоков на ETL ... согласно требованиям по FSD Осуществление функциональной поддержки (3-я линия) Требования: Опыт работы разработчиком ... SQL (GreenPlum, Oracle) - 3 года Опыт работы с ETL инструментами (AirFlow, Informatica IPC) Опыт работы ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании Альфа-БанкАльфа-Банк
  • Москва
месяц назад
IT-компания GNIVC- партнер государственных компаний и лидеров российского бизнеса, разработчик и системный ... разработка и сопровождение процессов обработки данных; проектировать, разрабатывать и сопровождать ETL ... на базе Hadoop: понимание архитектуры HDFS и форматов хранения (Parquet, ORC, Avro); опыт разработки ETL ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ГНИВЦГНИВЦ
  • Москва
24 дня назад
Что нужно будет делать: Разрабатывать и поддерживать ETL процедуры в Airflow Проектировать, реализовывать ... инфраструктуры Ожидания Иви от кандидата: Уверенное знание SQL Уверенное знание Python Опыт разработки ETL ... реляционными СУБД Навыки командной разработки в Git Будет плюсом опыт работы с: Современными code-driven ETL ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ИвиИви
  • Москва
2 месяца назад
до 200 000 ₽
... Разработчику уходит реализация, DevOps - контур и деплой. Вторая половина роли - развитие аккаунта. ... семантический слой Писать ТЗ и спецификации интеграций Проектировать пайплайны загрузки: REST/SOAP API, ETL ... зерна витрины, ER-диаграммы Опыт проектирования аналитических решений и интеграций - REST/SOAP API, ETL ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании Рафт Диджитал СолюшенсРафт Диджитал Солюшенс
  • Москва
2 дня назад
IT-компания GNIVC- партнер государственных компаний и лидеров российского бизнеса, разработчик и системный ... написание хранимых процедур и функций, оптимизация запросов (индексы, materialized views, EXPLAIN ANALYZE), ETL-пайплайны ... продуктовые каталоги, поиск/рекомендации); навыки организации разметки данных и data pipeline engineering (ETL ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ГНИВЦГНИВЦ
  • Москва
3 дня назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.