Инженер по обеспечению надежности генеративного ИИ

AI/ML 🔴 РФ/РБ 🏢 Офис Full-time
LLM
Опубликовано: 2026-09-07
Опубликовано более 14 дней назад
| 📰 Источник: myresume_ru

Технологии

GenAI ML LLM vLLM Text Generation Inference Triton Inference Server llama.cpp GPU API OpenAI-compatible interfaces RAG Embeddings Vector search

Описание вакансии

Кратко о роли

Lamoda ищет инженера по обеспечению надежности генеративного ИИ для работы над внедрением и эксплуатацией ML-платформ.

Ключевые задачи

  • Внедрение и эксплуатация GenAI и ML-платформ.
  • Работа с LLM-инференсом и оптимизация производительности.
  • Проектирование и эксплуатация API для доступа к моделям.
  • Настройка и поддержка RAG-систем.
  • Мониторинг ресурсов GPU и стоимости инференса.

Обязательные требования

  • Опыт промышленной разработки или эксплуатации GenAI/ML-платформ.
  • Практический опыт работы с LLM-инференсом (vLLM, TGI, Triton, llama.cpp).
  • Понимание метрик эксплуатации LLM (задержки, throughput, память).
  • Опыт проектирования API (авторизация, лимиты, маршрутизация).
  • Знание принципов RAG (эмбеддинги, векторный поиск, reranking).
  • Готовность работать в офисе в Москве.

Условия и бенефиты

  • Фултайм занятость.
  • Работа в офисе (Москва).
  • Зарплата по итогам собеседования (ориентировочно 300 000 – 450 000 ₽).

Процесс найма

  • Для отклика перейдите по ссылке на карьерный сайт компании.

Похожие актуальные вакансии