Data Engineer (Senior)

По договоренности


О роли

Twinby — один из крупнейших российских дейтинг-сервисов, миллионы пользователей. Мы перестраиваем разработку Twinby CIS и собираем команду данных заново. Данные продукта приходят из множества источников — продуктовые сервисы, события приложений, платежи, маркетинг — и должны надёжно доезжать туда, где на них строят аналитику и принимают решения.

Data Engineer здесь — единая точка ответственности за движение данных: чтобы они доехали полностью, без потерь и дублей, вовремя и в предсказуемом виде. Ты строишь и держишь пайплайны как настоящий продакшн-сервис, а не как набор разовых выгрузок.

За что ты отвечаешь

  • Захват и доставку данных из продуктовых источников в аналитический контур: потоковый и пакетный ingestion, изменения и удаления, а не только «снимок на вчера».

  • Надёжность доставки: идемпотентность и дедупликация, обработка поздних и переупорядоченных событий, воспроизводимый пересчёт после сбоя.

  • Оркестрацию пайплайнов: запуск по готовности источников, а не по таймеру; зависимости, ретраи, бэкфиллы без даунтайма и без задвоения.

  • Качество данных: тесты данных, проверки свежести и полноты, сверки с источниками, обнаружение аномалий — так, чтобы расхождение было видно раньше, чем его заметит потребитель.

  • Наблюдаемость пайплайнов: метрики доставки, лаг, алерты на разрыв; разбор инцидентов данных до причины и защита от повтора.

  • Контракты и эволюцию схемы: изменения источника не должны молча ломать поток; обратная совместимость и понятные границы ответственности.

Ты работаешь в связке с командой аналитики: ты отвечаешь за то, что данные доезжают надёжно, аналитика — за модель и метрики поверх них.

Кого мы ищем

Data Engineer, который владел движением данных целиком, а не писал разовые выгрузки. Для этого направления это значит:

  • Инженерия доставки. Ты думаешь про гарантии доставки, идемпотентность и дедуп на рефлексе; перезапуск пайплайна для тебя не повод бояться дублей.

  • Поток, а не только снапшот. Тебе близок захват изменений из меняющихся под тобой баз, поздние и out-of-order события, инкрементальная загрузка на больших объёмах.

  • Качество как часть инженерии. Ты сам ставишь тесты данных, проверки свежести и сверки, а не ждёшь, пока кто-то заметит, что данных не хватает.

  • Надёжность пайплайнов. SLA на свежесть, наблюдаемость, разбор инцидентов без поиска виноватого — для тебя это обычная инженерная гигиена.

  • Зрелость в выборе. Ты решаешь, где достаточно at-least-once с дедупом, а где нужна более строгая семантика, и не усложняешь там, где не нужно.

Мы смотрим на доказанную глубину владения движением данных, а не на длину списка инструментов.

Будет плюсом

  • Опыт построения потоковой доставки или захвата изменений с продуктовых баз на масштабе.

  • Опыт бэкафилла большой истории и миграции хранилища без остановки потока.

  • Опыт работы с платёжными или иными потоками, где дубль и потеря стоят дорого.

Чего НЕ требуем

Заученного синтаксиса конкретного оркестратора, сертификатов, знания именно нашего стека или домена дейтинга. Важнее инженерная зрелость и то, что данные у тебя доезжают надёжно и предсказуемо.

Технический стек

Потоковая и пакетная обработка данных, захват изменений (CDC), оркестрация пайплайнов, аналитические хранилища, Python и SQL.

Clickhouse, Apache Airflow

Что предлагаем

  • Планку с нуля: команда данных собирается заново — то, что ты заложишь в надёжность и качество данных, станет стандартом.

  • Настоящую инженерную систему: пайплайны как продакшн-сервис, тесты данных и наблюдаемость вместо ручных сверок, разбор инцидентов без вины.

  • Автономию владельца — ты решаешь «как» движется поток данных; цели и направление обсуждаешь с командой и руководителем.

  • Масштаб и большие данные, где инженерия движения имеет вес.

  • Формат: удалёнка, РФ.


Поделиться:

Опубликована 17 дней назад

Похожие вакансии

Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно
Сейчас мы ищем кандидатов на позицию Data Engineer! Что нужно будет делать? ... Зависит от проекта и этапа его жизненного цикла, но в целом: Проектировать и разрабатывать production data ... данных в промышленных СУБД (PostgreSQL/Greenplum/Oracle/ClickHouse/MS SQL); Поддерживать и развивать Data ...
  • Можно удаленно
  • Полный день
  • Опыт от 5 лет
Логотип компании Decart IT-productionDecart IT-production
  • Санкт-Петербург
20 дней назад
100 000 - 150 000 ₽
Обязанности: Разобраться в существующем Python/SQL/TypeScript-коде, зафиксировать модули, зависимости и контракты. Определять минимально достаточную архитектуру следующего этапа (переход к серверному API, при необходимости — к PostgreSQL). Декомпозир...
  • Можно удаленно
  • Частичная занятость
  • Опыт от 5 лет
Логотип компании СЗЭСКСЗЭСК
  • Санкт-Петербург
13 дней назад
Мы ищем сильного Senior DevOps Engineer , который поможет спроектировать и настроить инфраструктуру нового ... Будет плюсом: Опыт работы с Big Data или инфраструктурой, где генерируются большие объёмы данных.
  • Можно удаленно
  • Полный день
  • Опыт от 5 лет
Логотип компании SDOSDO
  • Санкт-Петербург
месяц назад
Мы ищем AI Data Engineer, который будет работать на внешних проектах наших клиентов (формат аутстаффинга ... Опыт работы в роли Data Engineer / Data Analyst на проектах, связанных с миграцией и трансформацией данных ...
  • Можно удаленно
  • Подработка
  • Опыт от 5 лет
Логотип компании Napoleon ITNapoleon IT
  • Санкт-Петербург
4 месяца назад
Ищем сильного Data Analyst (аналитика-разработчика) в департамент Data & ML — человека, который берёт ...
  • Можно удаленно
  • Полный день
  • Опыт от 5 лет
Логотип компании TwinbyTwinby
  • Санкт-Петербург
17 дней назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.