Data engineer

По договоренности


Мы — команда, отвечающая за функционирование и бесперебойную поставку данных в аналитическую платформу данных розничного бизнеса на базе Greenplum и ClickHouse (промышленные витрины и лаборатория данных для аналитиков, объем данных – сотни Тб). Наша работа — это фундамент, на котором аналитики и data scientists строят свои модели и принимают ключевые бизнес-решения. Мы ищем коллегу, который поможет нам поддерживать и развивать платформу, автоматизировать процессы обработки данных и следить за качеством информации.

Обязанности

  • обеспечивать поставку данных: загружать данные на платформы Greenplum и Clickhouse с помощью наших внутренних инструментов. создавать собственные инструменты для поставки данных
  • управлять платформой: разрабатывать и внедрять сервисы для автоматизации управления платформой: вакуум, сбор статистики, удаление ненужных таблиц, оптимизация физ.дизайна, выявление токсичной активности и т.д
  • мониторить и оптимизировать: отслеживать состояние ETL-процессов в Airflow и собственных решениях) реагировать на сбои, находить и устранять "бутылочные горлышки" в дата-пайплайнах для ускорения загрузки
  • автоматизировать рутину: писать скрипты на Python для автоматизации повторяющихся задач по обработке данных
  • вести документацию: разрабатывать и поддерживать техническую документацию и базу знаний по нашим процессаму
  • участвовать в R&D: тестировать новые технологии и инструменты для улучшения нашей платформы данных.

Требования

  • опыт работы: не менее 2 лет в качестве Data Engineer / ETL Developer
  • python: написание дагов в Airflow, асинхронность (asyncio), взаимодействие через драйверы (psycopg2, clickhouse-driver), pandas, работа с API, веб-сервисы (FastAPI)
  • SQL: уверенное владение: сложные запросы, оконные функции, CTE, умение читать планы выполнения, оптимизация запросов
  • СУБД: знание архитектуры и опыт работы с МРР СУБД (Greenplum, Teradata, Exadata)
  • DWH/ETL: знание современных принципов обработки данных Опыт разработки ETL-процессов, построения хранилищ и витрин данных
  • теоретическая база: понимание принципов работы реляционных СУБД, архитектуры DWH/витрин данных и ETL/ELT-процессов инструментов
  • опыт использования планировщиков задач (Airflow или аналоги)
  • проактивность: желание развиваться в области инженерии данных, учиться новому и самостоятельно решать сложные проблемы.
  • коммуникация и командная работа: способность не только самостоятельно решать задачи, но и эффективно взаимодействовать с другими командами, вы умеете аргументированно доносить свою позицию, договариваться с внутренними бизнес-заказчиками и поставщиками сервисов и координировать совместную работу для достижения общей цели.
  • английский: свободное чтение технической документации
  • навыки работы с генеративными AI-моделями;
  • опыт создания AI-агентов и использования их в работе будет преимуществом
  • опыт использования GigaChat, Kandinsky и аналогов в продуктах, навыки создания и использования AI-агентов
  • инструментальное владение AI для анализа, генерации и автоматизации

Условия

  • офисный формат (Поклонная 3к1)
  • ежегодный пересмотр зарплаты и годовая премия
  • расширенный ДМС и льготное страхование для семьи
  • уникальная система обучения Сбера для профессионального и карьерного развития
  • выгодная ипотека для сотрудников
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера
  • корпоративная пенсионная программа.

Поделиться:

Опубликована 2 дня назад

Похожие вакансии

Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно
Cтек технологий Big Data (Hadoop, Spark, Hive/Impala) и любой СУБД.
  • Полный день
  • Опыт от 3 лет
Логотип компании Bell IntegratorBell Integrator
  • Москва
3 дня назад
от 280 000 ₽
Выше средней на 21%
Сейчас в нашей команде открыта позиция Data Engineer. ... Проектирование архитектуры данных в Data Lake и Data LakeHouse. ... Требования: 3+ лет опыта в области Data Engineering, Data Governance, Data Quality или Data Platform.
  • Полный день
  • Опыт от 3 лет
Логотип компании Digital ChiefDigital Chief
  • Москва
3 дня назад
Мы ищем талантливого Data Engineer, который готов столкнуться с непростыми задачами в области хранения ... опыт разработки и сопровождения пайплайнов данных Опыт работы с PySpark, Python и SQL Опыт работы с Data ... данных Будет плюсом: Опыт работы с Trino+S3 Опыт оркестрации пайплайнов с помощью Airflow Знакомство с Data ...
  • Полный день
  • Опыт от 3 лет
Логотип компании Московский метрополитенМосковский метрополитен
  • Москва
5 дней назад
до 295 000 ₽
Выше средней на 28%
Cтек технологий Big Data (Hadoop, Spark, Hive/Impala) и любой СУБД.
  • Полный день
  • Опыт от 3 лет
Логотип компании Bell IntegratorBell Integrator
  • Москва
5 дней назад
... изучению) опыт с Hadoop (HDFS, YARN, Hive) знание облачных платформ (AWS S3/Glue, GCP BigQuery, Azure Data ...
  • Полный день
  • Опыт от 3 лет
Логотип компании СБЕРСБЕР
  • Москва
6 дней назад

Похожие вакансии

Логотип компании Bell IntegratorBell Integrator
от 280 000 ₽
Логотип компании Digital ChiefDigital Chief
Логотип компании Московский метрополитенМосковский метрополитен
до 295 000 ₽
Логотип компании Bell IntegratorBell Integrator
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.