Data Engineer (RAG / AI Platform)

По договоренности


Мы строим DataPlatfrom и AI-инфраструктуру, в которой инженеры, аналитики и разработчики смогут использовать современные подходы Retrieval-Augmented Generation (RAG) без боли и ручных костылей.
Наша цель — сделать RAG таким же привычным компонентом платформы, как SQL, Spark или CI/CD.
Для этого мы ищем Platform Data Engineer, который поможет сформировать и стандартизировать RAG-pipeline — от загрузки данных и чанкирования до метрик качества и retrival-механизмов. Дополнительным вызовом будет создание агентов для целей Data Platform используя RAG.

⚙️ Задачи:

  • Проектировать и внедрять RAG-пайплайны уровня платформы: ingestion данных, чанкирование, эмбеддинги, retrival, оценка качества ответов.
  • Исследовать SOTA-методы RAG (chunking, reranking, hybrid retrival, eval frameworks — RAGAS, TruLens, Langfuse, etc.) и адаптировать их под инфраструктуру Data / Dev Platform.
  • Создавать reusable компоненты (Python-библиотеки, API, Helm-чарты, шаблоны пайплайнов) для команд-потребителей.
  • Встраивать RAG в экосистему платформы: от self-service интерфейсов до observability и developer experience.
  • Разрабатывать метрики качества и мониторинг RAG-решений: faithfulness, groundedness, latency, coverage.
  • Агрегировать и распространять практики подготовки данных для использования в RAG.
  • Участвовать в воркшопах и кодлабах, обучать команды применению AI в продакшене.

🧩 Требования:

  • Уверенные знания Python, SQL.
  • Понимание архитектуры RAG-систем.
  • Опыт работы с LLM и embeddings — OpenAI, Gemini, Mistral.
  • Опыт работы с Docker, Git, Linux, Bash, знание CI/CD.
  • Понимание общих принципов устройства СУБД (реляционных + NoSQL).
  • Знание подходов по организации ETL-процессов, инструментов построения ETL.

🧩 Будет плюсом:

  • Практический опыт с векторными БД (Milvus, Qdrant, FAISS, Chroma).
  • Понимание ML evaluation и метрик RAG-решений.
  • Опыт с LangChain / LlamaIndex .
  • Опыт построения retrival-и-eval pipelines в проде.
  • Знание Trino / ClickHouse / Greenplum / Spark — как источников данных.
  • Понимание принципов System Design / архитектуры ML-платформ.

Поделиться:

Опубликована 23 дня назад

Похожие вакансии

КОМПАНИЯ «АЙ-ТЕКО» - ведущий российский системный интегратор и поставщик информационных технологий для корпоративных заказчиков. Активно действует на рынке IT России с 1997 года, входит в ТОП-400 крупнейших российских компаний, ТОП-5 крупнейших IT-ко...
  • Полный день
  • Опыт от 3 лет
Логотип компании ИЦ АЙ-ТЕКОИЦ АЙ-ТЕКО
  • Москва
10 часов назад
Ищем коллегу, который погрузится в тонкости работы экосистемы данных в Okko и поможет в решении таких задач как: внедрение ETL-процессов на Airflow; создание витрин данных; участие в построении DWH; участие в проектировании модели данных; администрир...
  • Полный день
  • Опыт от 3 лет
Логотип компании OkkoOkko
  • Москва
день назад
Делаем банк для тех, кто живёт жизнь. И сами следуем этому принципу: любим спортик, вкусную еду, красивые вещи, встречи с друзьями. А ещё считаем, что всё вокруг должно быть в удовольствие — в том числе банкинг. Для нас важно быть визионерами во всём...
  • Полный день
  • Опыт от 3 лет
Логотип компании РокетбанкРокетбанк
  • Москва
день назад
Прикладная аналитическая платформа Блока Риски - это решение, позволяющее создавать аналитические витрины на Облаке Данных по различным направлениям бизнеса таких как: расчет оптимальных стратегий взыскания расчет предложений по реструктуризации расч...
  • Полный день
  • Опыт от 3 лет
Логотип компании СБЕРСБЕР
  • Москва
день назад
НАШ СТЕК: Hadoop, GreenPlum, S3; Airflow, Spark, Kafka, Debezium; ClickHouse, Superset; ЧТО ТЕБЯ ЖДЕТ: Анализ имеющегося функционала хранилища данных для целей миграции бизнес-процессов; Анализ новых требований от заказчиков по задачам развития отчет...
  • Полный день
  • Опыт от 3 лет
Логотип компании ИЦ АЙ-ТЕКОИЦ АЙ-ТЕКО
  • Москва
день назад
Департамент информационных технологий Москвы создает и развивает цифровые проекты, которые делают столицу комфортнее, а жизнь горожан — удобнее и мобильнее. Для системы управления столицей технологии — это незаменимый инструмент, который применяется ...
  • Полный день
  • Опыт от 3 лет
Логотип компании ГКУ ИнфогородГКУ Инфогород
  • Москва
день назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.