Senior/Lead QA Engineer (AI/LLM Products)
По договоренности
Мы разрабатываем AI-инструменты / LLM-платформу / автоматизацию на базе ИИ. Ищем QA-инженера, который будет отвечать за качество наших AI-продуктов: от классического функционального тестирования до оценки качества ответов LLM и устойчивости промптов.
Тестирование AI-систем отличается от классического: результат недетерминирован, «правильный ответ» не всегда один, а баг может проявляться в 1 случае из 20. Нам нужен человек, которому интересно работать именно с этой спецификой.
Чем предстоит заниматься:
- функциональное и регрессионное тестирование продуктов с LLM-компонентами (веб-интерфейсы, API, интеграции)
- разработка и поддержка наборов тестовых сценариев для оценки качества ответов моделей (evaluation datasets, golden sets)
- тестирование промптов: проверка устойчивости к перефразированию, edge-кейсам, инъекциям и джейлбрейкам
- оценка ответов LLM по критериям: точность, полнота, галлюцинации, соответствие формату (structured output / JSON schema)
- анализ недетерминированного поведения: воспроизведение плавающих дефектов, статистическая оценка стабильности
- автоматизация рутинных проверок на Python (pytest): smoke-тесты API, прогоны evaluation-сценариев, скрипты для массовой проверки ответов модели
- тестирование API-интеграций с LLM-провайдерами лимиты, ретраи, обработка ошибок, стриминг
- ведение тестовой документации, баг-репортов, участие в приёмке фич
- взаимодействие с разработчиками и ML-инженерами при разборе дефектов.
От кандидатов ждем:
- опыт в тестировании от 5 лет (ручное + автоматизация)
- практический опыт работы с AI-инструментами: ChatGPT, Claude, Copilot и аналоги — не на уровне «пробовал», а как рабочий инструмент
- понимание основ промпт-инжиниринга: структура промпта, few-shot, chain-of-thought, sdd, работа с системными промптами
- уверенное тестирование API (Postman / curl / HTTP-клиенты), чтение JSON, понимание REST
- понимание специфики LLM: недетерминированность, галлюцинации, ограничения контекста, температура и параметры генерации
- python на базовом уровне для автотестирования: умение написать и поддерживать автотесты (pytest / requests / playwright), понимание структуры тестового проекта, работа с фикстурами и ассертами
- умение писать чёткие баг-репорты и тест-кейсы, включая случаи «модель ответила неправильно» с воспроизводимыми условиями.
Будет плюсом:
- продвинутая автоматизация UI (Playwright / Selenium), опыт построения фреймворков с нуля
- опыт построения LLM-evaluation пайплайнов (promptfoo, LangSmith, Ragas, собственные фреймворки)
- понимание RAG-архитектур
- опыт тестирования безопасности LLM: prompt injection, jailbreaks, утечки данных.
Мы предлагаем:
- срочный трудовой договор до 01.07.2027
- офисный формат работы на период испытательного срока, далее возможен гибридный формат
- ежегодный пересмотр зарплаты
- корпоративный спортзал и зоны отдыха
- более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
- программа адаптации и помощь руководителя на старте (для Junior позиций)
- расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
- гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
- подписка СберПрайм с возможностью совместного использования на трёх близких
- вознаграждение за рекомендацию друзей в команду Сбера.
Опубликована 6 дней назад
Похожие вакансии
Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатноВ связи с предстоящим расширением команды приглашаем Middle+Senior QA.
- Полный день
- Опыт от 3 лет
- Москва
2 дня назад
ИТ B2C — самая крупная экосистема в Сбере. Нас более 8000 человек в 18 городах России. Мы занимаемся разработкой и развитием розничных решений, помогая сделать сервисы Банка доступнее, безопаснее и удобнее. Ждем именно тебя! Мы – команда платформы Sb...
- Полный день
- Опыт от 3 лет
- Москва
2 дня назад
до 220 000 ₽
Выше средней на 6%
Мы ищем внимательного и увлечённого специалиста, который поможет нам поддерживать высокое качество проектов серии игр ИЛ-2, основанной на собственном игровом движке. Обязанности: Проводить функциональное и интеграционное тестирование игровых аспектов...
- Полный день
- Опыт от 3 лет
- Москва
6 дней назад
Основные задачи: Проводить тестирование различных компонентов продукта (витрины данных, внешние и внутренние интеграции, сервисы, API) Проводить тестирование пайплайна данных и построение DWH Выявлять, локализовывать и описывать дефекты Формировать о...
- Полный день
- Опыт от 3 лет
- Москва
6 дней назад
Ключевые задачи: Тестирование нового функционала; Проведение регрессионного тестирования; Проведение интеграционного тестирования; Локализация найденных дефектов и их оформление; Написание тестовой документации (тест-кейсы); Поддержание тестовой моде...
- Полный день
- Опыт от 3 лет
- Москва
11 дней назад
от 568 000 ₽
Выше средней на 173%
Требования Мы ждём что ты: • имеешь опыт работы в QA 5+ лет (автоматизированное тестирование) • обладаешь ... опытом работы 2+ года на позиции Senior Automation QA Engineer (будет плюсом) • свободно владеешь языками ... поддерживать автоматизацию на разных языках и фреймворках • применял AI-агенты в повседневной работе QA ...
- Полный день
- Опыт от 3 лет
- Москва
4 дня назад
Вакансия в подборках
Похожие вакансии
до 220 000 ₽