Разработчик на C++ в YandexGPT (Нейро)

По договоренности


Наша команда разрабатывает и развивает бэкенды на основе LLM-моделей (под брендом YandexGPT/Алиса). Мы занимаемся непосредственно инференсом на GPU-ускорителях, а также огромным спектром вопросов, связанных с развитием и поддержкой продукта: API взаимодействия с фронтендом, реализацией ML-стека в рантайме, логами для аналитики и многим другим. Вместе с нами вы сможете поработать над сложными и разнообразными задачами.

Какие задачи вас ждут

Инференс тяжёлых языковых генеративных моделей на GPU-ускорителях
Сердце LLM-based-продуктов — это, конечно, непосредственное вычисление LLM-моделей. Вас ждёт решение задач аллокации различных компонентов с LLM-моделями, настройка их взаимодействия, релизных процессов, подбор различных параметров для оптимизации.

Оптимизация методов распределения работы между вычислительными узлами
Можно оптимизировать не только само вычисление, но и методы разделения входящего потока между узлами, чтобы добиться наиболее выгодного по latency распределения работы между узлами. Также мы экспериментируем с отложенным продолжением вычислений.

Разработка различных кусков многокомпонентной системы
Ответ на основе поисковых источников — сложный многокомпонентный продукт. Важно не только вычислить что-то с помощью LLM-модели, но и: 1) приносить данные на вход модели; 2) правильно сохранять результаты для отдачи их пользователям; 3) настраивать взаимодействие с фронтендом (стриминг, например); 4) обеспечивать продуктовым и ML-командам возможность проводить эксперименты и улучшать продукт. Всё вместе порождает немало содержательных и сложных задач. Работа в бэкенде поисковых LLM открывает много технических вызовов, менее привычных в продуктах, которые не работают с LLM-моделями. Ведь вычисления, длящиеся не сотни миллисекунд, а многие секунды, требуют пересмотра устоявшихся подходов.

Мы ждем, что вы

  • Разбираетесь в базовых алгоритмах и структурах данных
  • Хорошо знаете С++
  • Знакомы с паттернами и идиомами построения программного обеспечения
  • Умеете писать надёжный и читабельный многопоточный код
  • Разрабатывали большой сервис в команде

Адрес: Россия, Санкт-Петербург, Пискарёвский проспект, 2к2
Показать на большой карте

Поделиться:

Опубликована 7 дней назад

Похожие вакансии

Вакансии быстро закрываются — подпишитесь на наш канал в MAX сейчас, чтобы видеть их первыми.
Подписаться в MAX
Проверять весь код, который попадает в репозитории — написанный разработчиками и сгенерированный Claude ... Обучать разработчиков работе с Claude Code, делиться практиками промпт-инжиниринга, повышать эффективность ...
  • Полный день
  • Опыт от 5 лет
Логотип компании BI ConsultBI Consult
  • Санкт-Петербург
20 часов назад
Торгово-промышленная группа «ТАЙПИТ» приглашает присоединиться к команде Разработчика встраиваемых систем ...
  • Полный день
  • Опыт от 5 лет
Логотип компании ТАЙПИТ, Торгово-промышленная группаТАЙПИТ, Торгово-промышленная группа
  • Санкт-Петербург
4 дня назад
Наш проект - инновационная платформа, которая объединяет передовые технологии: Генеративный AI – создание и обработка контента; Компьютерное зрение – распознавание изображений и видео; Умный поиск и анализ информации в реальном времени. Мы ищем проак...
  • Полный день
  • Опыт от 5 лет
Логотип компании ЦРТ | Группа компанийЦРТ | Группа компаний
  • Санкт-Петербург
9 дней назад
В техническую команду сервиса требуется Senior Backend-разработчик Java/Kotlin.
  • Полный день
  • Опыт от 5 лет
Логотип компании OkkoOkko
  • Санкт-Петербург
6 дней назад
В Ваши обязанности будет входить: Участие в разработке радиоэлектронной аппаратуры; Участие в разработке конструкторской и эксплуатационной документации; Разработка и выдача технических заданий (требований) в смежные отделы по тематике работы (в част...
  • Полный день
  • Опыт от 5 лет
Логотип компании НИИ ВекторНИИ Вектор
  • Санкт-Петербург
6 дней назад
Мы обрабатываем данные посетителей и используем куки в соответствии с политикой конфиденциальности.