Data Engineer
По договоренности
- Автозаводская
- Технопарк
- Шаболовская
Проект Банка ТОП-3. Команда проекта создает и развивает корпоративный движок потоковой обработки данных
Твои задачи:
- Разрабатывать и поддерживать коннекторы для интеграции Flink с Kafka, S3-совместимыми хранилищами, HBase, аналитическими СУБД и другими корпоративными системами
- Реализовывать и оптимизировать Stateful-обработку данных, работать со State Backends, RocksDB, Heap и внешними хранилищами состояния
- Развивать механизмы отказоустойчивости: checkpointing, savepoints, автоскейлинг, восстановление после сбоев, High Availability
- Интегрировать Flink-приложения с системами аутентификации, управления секретами, логирования, мониторинга и аудита
- Настраивать и сопровождать мониторинг Flink-кластеров и задач: JVM-метрики, backpressure, checkpoint duration, consumer lag, watermarks
- Развивать процессы развертывания, обновления, остановки и отката приложений через CI/CD
- Проводить нагрузочное тестирование, искать узкие места и оптимизировать latency и throughput потоковых процессов
- Развивать и сопровождать Flink History Server
- Консультировать команды data-инженеров по разработке Flink-приложений, SQL и настройке state
- Готовить техническую документацию, шаблоны развертывания, чек-листы и руководства по эксплуатации
- Участвовать в тестировании и приемке платформенной функциональности
Что мы ждем от тебя:
- Опыт работы Data Engineer или разработчиком от 3 лет
- Не менее 2-х лет опыта с потоковой обработкой данных или Big Data: Apache Flink, Kafka Streams, Spark Streaming или аналогичные технологии
- Уверенное знание Java или Scala
- Опыт разработки промышленных приложений для распределенных систем
- Практический опыт работы с Apache Flink
- Практический опыт работы с Kafka: producers, consumers, offsets, обработка ошибок
- Опыт работы с Docker и Kubernetes
- Понимание Prometheus и Grafana, опыт настройки оповещений и анализа метрик
- Продвинутый уровень SQL, опыт оптимизации запросов
- Умение работать с технической документацией
- Способность самостоятельно декомпозировать сложные технические задачи и взаимодействовать с разработчиками, DevOps- и data-командами
Будет плюсом
- Опыт разработки собственных коннекторов или форматов данных для Flink
- Опыт работы с HDFS, HBase, Hive
- Понимание принципов работы с S3-совместимыми объектными хранилищами
- Опыт работы с ELK, Jaeger, Zipkin
- Понимание Data Lineage и опыт интеграции с инструментами прослеживаемости данных
- Опыт работы с Flink Table API / SQL
- Знакомство с Apache Paimon, Apache Iceberg, Fluss или аналогичными Lakehouse-технологиями
Что мы обеспечиваем:
- Внутренние семинары, митапы, мы очень любим учиться новому
- ДМС со стоматологией для сотрудников и скидку на покупку ДМС для ближайших членов семьи
- Технику для комфортной работы
- Сессии профессионального развития персонала, результатом которой является план индивидуального развития каждого сотрудник
Адрес: Россия, Москва, Новоданиловская набережная, 10
Опубликована 2 часа назад
Похожие вакансии
Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатноИщем в команду аналитика данных, для улучшения операционного качества работы сотрудников наших офисов. Обязанности сбор, обработка, анализ исходных данных подготовка презентационных материалов разработка алгоритмов в Greenplum контроль качества данны...
- Полный день
- Опыт от 1 года
- Москва
3 дня назад
... в рамках плановой трансформации процессов и поддержки текущих бизнес-задач, мы находимся в поисках Data ... Platform Engineer, который совмещает data engineering, backend и platform: проектирует архитектуру, ... запросов Apache Airflow - разработка и поддержка DAG-ов PySpark - трансформация и агрегация данных Data ...
- Полный день
- Опыт от 1 года
- Москва
2 часа назад
Опыт работы со стеком технологий Big Data (Hadoop, Spark, Hive/Impala) и любой СУБД, Python (PySpark, ...
- Полный день
- Опыт от 1 года
- Москва
6 дней назад
... аналитические функции, подзапросы, хранимые процедуры, оптимизация производительности); Cтек технологий Big Data ...
- Полный день
- Опыт от 1 года
- Москва
4 дня назад
В связи с активным развитием проектов в компании открыта вакансия Data инженера на проект Сбера. ... Проект находится на стыке Big Data, аналитики, ML, алгоритмов принятия решений и backend-разработки. ... Здесь предстоит работать с большими объемами данных, проектировать и развивать data pipeline, аналитические ...
- Полный день
- Опыт от 1 года
- Москва
13 дней назад