Стажер Data Scientist (Риски)
По договоренности
Команда занимается разработкой NLP-моделей и решений на основе LLM для операционных рисков. Решаем задачи по построению AI-агентов и мультиагентных систем.
Примеры:
- система гардрейлов (в том числе на Jev-like моделях) для защиты LLM и AI-агентов Сбера от промпт-атак и джейлбрейков
- агентная память банка на базе темпорального графа знаний, учитывающего версии и изменения внутренней документации во времени
- Harness, который автономно превращает DS-код в продакшн-сервис — от сборки проекта по стандарту и интеграций до деплоя на стенды и тестирования
- AI-агенты для оценки рисков компаний экосистемы Сбера по внутренним документам, новостям, отчетности и описанию бизнес-процессов
- мультиагентная система по анализу репозиториев кода на уязвимости бизнес-логики и сверки с требованиями
- AI-агент DataEngineer для автономного анализа данных, поиска ошибок и аномалий, создания проверок качества данных, создания выгрузок и витрин.
Обязанности
- разработка PoC и MVP AI-агентов с использованием фреймворков для работы с LLM
- адаптация и дообучение LLM на внутренних и внешних данных (SFT, LoRA, DPO, GRPO)
- участие в выводе AI-агентов в продакшн, их интеграции и мониторинге качества
- написание качественного кода и обсуждение технических решений с командой.
Требования
- неоконченное высшее техническое образование с хорошей подготовкой в области математики и алгоритмов
- знание Python, статистики и ML/DL-стека
- опыт проектирования и обучения нейросетей: от CNN/RNN до трансформеров
- опыт построения RAG-систем (классический RAG, GraphRAG, Agentic RAG)
- опыт разработки автономных AI-агентов (LangChain, LangGraph, Deep Agents)
- знание классических алгоритмов и структур данных, принципов ООП и паттернов проектирования
- умение писать чистый и поддерживаемый код (Clean Architecture, SOLID)
- опыт работы с Git.
Преимуществом будет:
- опыт работы с FastAPI, Docker, vLLM, Unsloth, Langfuse
- успехи в соревнованиях (например, Kaggle Expert+ или призовые места на хакатонах)
- вклад в open-source проекты, публикация моделей и датасетов на Hugging Face
- погружённость в тренды индустрии, интерес к свежим статьям и новым инструментам
- знание других языков программирования (например, C++, Java).
Условия
- оплачиваемая стажировка
- возможность выбрать удобный график – офис или гибрид (локация: м. Кутузовская)
- корпоративный спортзал и зоны отдыха.
Опубликована 3 часа назад
Похожие вакансии
Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатноИщем Data Scientist уровня Middle, который сможет разработать прогнозную модель и вместе с backend-разработчиком ... Мы ждем, что вы: имеете коммерческий опыт работы Data Scientist участвовали хотя бы в одном проекте, ...
- Полный день
- Опыт от 1 года
- Москва
3 часа назад
от 220 000 ₽
Выше средней на 120%
... предпринимателей, инструменты управления бизнесом, аналитические сервисы и новые услуги на основе Big Data ...
- Полный день
- Опыт от 1 года
- Москва
3 дня назад
Ключевые задачи: - Разработка моделей компонентов кредитного риска (PD, EAD, LGD) для корпоративных клиентов и финансовых институтов; - Разработка моделей стресс-тестирования корпоративного портфеля; - Мониторинг и совершенствование разработанных мод...
- Полный день
- Опыт от 1 года
- Москва
6 дней назад
На этой позиции нужен Data Scientist, который отвечает за смысл и качество решений агента и обработки ... open-source LLM и GigaChat во внутреннем контуре; предлагать и обосновывать стек под задачу Требования опыт в Data ...
- Полный день
- Опыт от 1 года
- Москва
4 дня назад
Требования: Опыт работы Data Scientist / Data Analyst / специалистом по прогнозированию от 2 лет.
- Нестандартный график
- Опыт от 1 года
- Москва
20 дней назад
Вакансия в подборках
Похожие вакансии
от 220 000 ₽