AI-инженер (LLM, локальные модели)
150 000 - 250 000 ₽
Выше средней на 33%
Ищем в команду AI-инженера на постоянную работу. Нужен человек, который по-настоящему разбирается в локальном AI и сам доводит задачи до работающего результата: поднимет у нас AI-сервер на открытых моделях и дальше будет делать на нём автоматизации под наши задачи.
Чем будете заниматься
- Поднять и вести локальный AI-сервер: выбрать железо (Mac Studio на 128–256 ГБ или NVIDIA DGX Spark), запустить открытые модели (Qwen, Kimi, Hermes и т.п.), следить, чтобы всё работало.
- Делать направленные автоматизации — по одной, без «комбайна на всё». Пример: сервер сам собирает данные из интернета в свою базу, держит их свежими и за секунды отдаёт другим AI-моделям (Claude, GPT) через API или MCP.
- Настраивать агентов вроде OpenClaw под конкретные задачи — в изоляции и с минимальными правами.
- Подсказывать, что выгодно перевести на локальные модели, а что дешевле оставить в облаке.
- Отвечать за безопасность: сервер закрыт снаружи, секреты не утекают, текст из интернета не управляет моделью.
Кто нам нужен
- Уже запускали модели локально (MLX, llama.cpp, Ollama, vLLM) и понимаете, какая модель на каком железе пойдёт и с какой скоростью.
- Понимаете квантизацию, контекст и память: где модель начнёт тормозить или ошибаться и что с этим делать.
- Строили поиск по своим данным: эмбеддинги, векторные базы, RAG.
- Уверенно пишете на Python, умеете парсить сайты и работать с API.
- Разбираетесь в агентах (OpenClaw и подобные) и MCP, следите за новыми открытыми моделями.
- Делаете сами и доводите до конца: не «надо изучить», а «вот работает, вот замеры».
- Плюсом: опыт на NVIDIA (CUDA) и проекты на GitHub, которые можно посмотреть.
Условия
- Постоянная работа, не разовый проект. Занятость — полная, частичную можно обсудить.
- Удалённо.
- Железо покупаем мы, выбираем вместе.
Как откликнуться
Откликайтесь здесь, на hh, и обязательно приложите сопроводительное письмо. В нём — 2–3 своих проекта с LLM (ссылки или пара строк о том, что сделали лично вы) и короткие ответы на три вопроса:
- Какую модель вы бы запустили на машине со 128 ГБ памяти, чтобы вытаскивать данные из веб-страниц, и какую скорость ожидаете?
- Как сделать, чтобы другая AI-модель получала свежие данные из нашей базы быстрее, чем за секунду?
- Что может пойти не так, если агент сам читает страницы из интернета, и как от этого защититься?
Отклики без ответов на вопросы, скорее всего, не будем рассматривать.
Сравнение со средней зарплатой в похожих вакансиях:
120k
172k
80k
145k
230k
Опубликована 4 дня назад
Похожие вакансии
Вакансии быстро закрываются - скачайте мобильное приложение в RuStore и откликайтесь первыми!
Скачать бесплатно215 000 - 320 000 ₽
Выше средней на 78%
Главная задача: Вести клиента от первой горячей заявки до подписания договора, сопровождая его на всех этапах. Что вам предстоит делать: Вести клиента от назначенной заявки до заключения договора на месте. Выезжать к клиентам на консультацию, проводи...
- Можно удаленно
- Частичная занятость
- Опыт до 1 года
- Москва
3 дня назад
до 220 000 ₽
Выше средней на 46%
Мы ожидаем, что ты: Имеешь опыт работы DevOps/SRE/Infra-инженером от 2 лет. ... Команду сильных инженеров и исследователей.
- Можно удаленно
- Полный день
- Опыт до 1 года
- Москва
7 дней назад
Ищем инженера с опытом работы с медицинскими изделиями для участия в их разработке, испытаниях и подготовке ...
- Можно удаленно
- Полный день
- Опыт до 1 года
- Москва
11 дней назад
О роли Техническая поддержка без администрирования инфраструктуры клиентов, важно понимать как устроен продукт, как он взаимодействует с базами данных, веб-сервером, а также как интегрируется с LDAP, SSO и другими компонентами инфраструктуры. Основна...
- Можно удаленно
- Полный день
- Опыт до 1 года
- Москва
12 дней назад
Сейчас мы расширяем команду и ищем QA-инженера для проекта по автоматизации производства.
- Можно удаленно
- Полный день
- Опыт до 1 года
- Москва
16 дней назад
Вакансия в подборках
Похожие вакансии
215 000 - 320 000 ₽
до 220 000 ₽