Инженер по ИИ/AI Agent Engineer (LLM & Agentic Systems)

Дата размещения вакансии: 06.08.2026
Работодатель: Градиент
Уровень зарплаты:
з/п не указана
Город:
Москва
Ленинградский проспект 72к1
Требуемый опыт работы:
От 1 года до 3 лет

Привет! Мы - компания "Градиент" и мы ищем Инженера, который возьмёт ownership над качеством и надёжностью наших AI-агентов и LLM-систем. Это глубоко техническая роль на стыке ML-инженерии и разработки: ты будешь проектировать многошаговые агентские сценарии, строить RAG-пайплайны, выстраивать процессы оценки качества и доводить решения до промышленной эксплуатации.

После твоего выхода:

  • Логика работы LLM в наших продуктах становится устойчивой и масштабируемой
  • Многошаговые AI-сценарии корректно работают под нагрузкой и в реальных бизнес-кейсах
  • Появляются воспроизводимые подходы к тестированию, оценке и улучшению качества ответов моделей
  • Команда понимает ограничения решений и может управляемо их развивать

Чем тебе предстоит заниматься:

Агентские системы:

  • Разрабатывать многошаговые цепочки AI-агентов: orchestration, routing, memory, tool calling
  • Проектировать и внедрять цепочки reasoning, проверок и fallback-механизмов
  • Диагностировать, где и почему ломается логика AI — не «плохой ответ», а почему система даёт такой ответ
  • Ставить guardrails на необратимые действия агентов, определять условия выхода из циклов

RAG и данные:

  • Строить end-to-end RAG-пайплайны: ingestion → chunking → embeddings → vector search + hybrid → reranking → prompt orchestration → grounding
  • Экспериментировать с retrieval-стратегиями: гибридный поиск (BM25 + dense), re-ranking, query rewriting
  • Организовывать пайплайн данных: сбор, нормализация, индексация, мониторинг

Качество и eval:

  • Разрабатывать и внедрять методики оценки RAG-систем и AI-агентов: offline-метрики, golden datasets, LLM-as-a-Judge, human evaluation, A/B-тесты
  • Выстраивать observability: логи, трейсы, мониторинг качества, версионирование промптов и датасетов
  • Контролировать retrieval-метрики (Hit Rate, MRR, NDCG@K), groundedness, уровень галлюцинаций

Что мы от тебя ждем:

Обязательно:

  • Опыта создания агентов на современных фреймворках (LangChain, LangGraph, LlamaIndex и тд)
  • Знания стратегий планирования AI-агентов (ReAct, Plan-and-Execute, Reflection и др.)
  • Сильный prompt engineering + chain/tool/function calling
  • Опыта работы с векторными БД (Weaviate, Pinecone, Qdrant, Milvus и др.)
  • Опыта оценки качества LLM-систем (RAGAS, DeepEval, LLM-as-a-Judge или аналоги)
  • Понимания агентских протоколов (MCP, A2A и тд)
  • Linux, Git, Docker, Python

Будет плюсом:

  • Понимание атак на LLM (Prompt Injection, Jailbreaks) и защиты от них (Guardrails)
  • Опыт дообучения моделей (LoRA/qLoRA) на специфических доменах
  • Опыт квантизации и оптимизации инференса (ONNX, AWQ)
  • Опыт с графовыми БД (Neo4j) и GraphRAG
  • MLOps-инструменты: MLflow, Kubeflow, DVC
  • Опыт с Kubernetes и высоконагруженными сервисами

Что мы предлагаем:

  • Комфортный офис в Бизнес-центре "Алкон", расположенном рядом с метро Сокол
  • График работы с 09:00 до 18:00 для поддержания баланса между работой и личной жизнью, а гибридный формат и ДМС ждет тебя после успешного прохождения испытательного срока
  • Испытательный срок длительностью 3 месяца для взаимной адаптации
  • Работа с современными технологиями и инструментами
  • Сильную и дружную команду профессионалов, готовых расти вместе с вами.
  • Скидки на всю нашу крутую продукцию!

Если ты готов к масштабному вызову, хочешь работать работать в команде, которая ценит профессионализм и инновации, — мы ждём тебя!

"Градиент" — там, где технологии становятся стратегией.