AI Researcher (Middle to Senior+) в RnD NLP (SberAI)

По договоренности

  • Спортивная
  • Киевская
  • Парк Победы

Мы — исследовательская команда, работающая на переднем краю LLM-технологий. Мейнстрим LLM-рецепт — это потолок, который мы пытаемся пробить: ищем архитектурные ходы, новые objective-функции, нестандартные режимы reasoning'а — всё, что может дать кратный прирост качества/скорости.

Жизненный цикл идеи: от гипотезы до PoC-фреймворка и прода флагманской LLM.

Если коротко: мы ищем людей, которым интересна прикладная исследовательская работа в среднем и высоком risk-reward профиле.

Над чем сейчас работаем (краткий примерный список):

* альтернативные архитектуры — encoder-decoder, гибридные attention (linear + softmax), sparse/MoE с нестандартным dispatching'ом, итеративные/loop-трансформеры;

* новые training objectives и режимы обучения — multi-token и future-state prediction, RL-pretraining, дистилляция против ансамблей teacher-моделей;

* reasoning — латентный/омнимодальный reasoning, обучаемые value-сети, MCTS-подобный поиск, self-play, ансамбли гетерогенных моделей;

* эффективность и inference — адаптивные вычисления, MoD/early-exit, serving для нестандартных архитектур;

* специализированные направления — символьные/фонетические задачи, креативная генерация, agentic capabilities.

Какие-то из гипотез этих треков доедут до PoC/прода, какие-то умрут на small-scale. Это ожидаемо.

One More Thing:

Если вы рок-звезда (уровень техлида и выше) — у нас отдельный трек найма. Предлагаем compute без бюрократии, можем обсудить запуск нового research-трека под вас, потенциально своя команда и инженерная поддержка под скейлинг, прямое участие в стратегии направления — что мы делаем, во что не верим, на чём фокусируемся на длинном горизонте.

Мы делаем ставку на архитектурные и training-инновации, где количество GPU перестаёт быть единственным фактором. Если такая постановка задачи будоражит кровь — пишите.

Обязанности

* разбирать существующие LLM-пайплайны до компонент, находить места для апгрейда не на 1%, а в разы;

* формулировать research-гипотезы и доводить их от абляций до полного pretrain/post-train цикла со scaling laws;

* обучать, валидировать, имплементировать новые архитектуры и objectives — иногда с залезанием в инфраструктуру (kernel'ы, training-фреймворк, serving);

* упаковывать результаты, доводить до PoC, инференс-движка, пилотных проектов;

* публиковаться на A/A*-конференциях — опционально, но мы поощряем.

Требования

* глубокое понимание современного трансформера и этапов LLM-пайплайна;

* умение писать качественный и воспроизводимый ML-код, опыт запуска/обучения моделей в multi-gpu (лучше в multi-node) режиме;

* практический опыт на каком-то из этапов LLM-строения — индустриальный или серьёзный pet-project, формат не принципиален;

* хорошая насмотренность по литературе и способность читать paper'ы критически, отличать зёрна от плевел;

* умение быстро валидировать смелые гипотезы;

Будет плюсом:

* опыт в классическом ML/NLP до эпохи больших моделей;

* публикации уровня A/A* и опыт прохождения review-цикла;

* опыт large-scale training (multi-node, FSDP/DeepSpeed/Megatron);

* призовые места в Kaggle и подобных.

Условия

  • комфортный современный офис рядом с м. Кутузовская
  • гибридный формат работы
  • ежегодный пересмотр зарплаты, годовая премия
  • корпоративный спортзал и зоны отдыха
  • система обучения для профессионального и карьерного развития
  • расширенный полис ДМС с первого дня работы и страхование для семьи
  • программа ипотеки для сотрудников
  • подписка Прайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера.

Адрес: Россия, Москва, Кутузовский проспект, 32
Показать на большой карте

Поделиться:

Опубликована 2 дня назад

Похожие вакансии

Вакансии быстро закрываются — подпишитесь на наш канал в MAX сейчас, чтобы видеть их первыми.
Подписаться в MAX
Мы — команда опытных и крутых специалистов, которые занимаются продвижением и созданием продуктов в IT ... Сейчас, в связи с расширением команды, мы в поиске Android Reverse Engineer / Mobile Security Researcher ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании Miles&MilesMiles&Miles
  • Москва
16 дней назад
120 000 - 150 000 ₽
Коротко о нас VAMI — рекрутинговое агентство, которое специализируется на сложных позициях в продуктовом IT ... рутины Какие вакансии ты будешь закрывать Примеры ролей, с которыми работает команда: ML Engineer / AI Researcher ... подход Опционально — работа в паре с сорсером: он находит, ты закрываешь Что мы ожидаем 3–4 года в IT-рекрутинге ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ArtVolkov.ruArtVolkov.ru
  • Москва
18 дней назад
Привет, уважаемый будущий коллега! Мы ищем специалиста по системному программированию и исследованию информационной безопасности для разработки контролируемых инструментов проверки защищенности и adversary emulation под Windows и macOS. P.S. - Минима...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании СО СП по ОУПДС по г. ТвериСО СП по ОУПДС по г. Твери
  • Москва
день назад
Мы обеспечиваем безопасность IT-инфраструктуры любого масштаба и сложности: от веб-сайтов и мобильных ... коммуникации Консультирование Наши ожидания от кандидата: Высшее юридическое образование Опыт работы юристом в IT-компании ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании StormWall™StormWall™
  • Москва
21 час назад
до 100 000 ₽
Активно действует на рынке IT России с 1997 года, входит в ТОП-400 крупнейших российских компаний, ТОП ... -10 крупнейших IT-компаний России. ... Будем рады пригласить в нашу дружную команду Администратор IT проектов Требования: • Высшее образование ...
  • Можно удаленно
  • Полный день
  • Опыт от 3 лет
Логотип компании ИЦ АЙ-ТЕКОИЦ АЙ-ТЕКО
  • Москва
день назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.