Ленинградский проспект 72к1
Привет! Мы - компания "Градиент" и мы ищем Инженера, который возьмёт ownership над качеством и надёжностью наших AI-агентов и LLM-систем. Это глубоко техническая роль на стыке ML-инженерии и разработки: ты будешь проектировать многошаговые агентские сценарии, строить RAG-пайплайны, выстраивать процессы оценки качества и доводить решения до промышленной эксплуатации.
После твоего выхода:
- Логика работы LLM в наших продуктах становится устойчивой и масштабируемой
- Многошаговые AI-сценарии корректно работают под нагрузкой и в реальных бизнес-кейсах
- Появляются воспроизводимые подходы к тестированию, оценке и улучшению качества ответов моделей
- Команда понимает ограничения решений и может управляемо их развивать
Чем тебе предстоит заниматься:
Агентские системы:
- Разрабатывать многошаговые цепочки AI-агентов: orchestration, routing, memory, tool calling
- Проектировать и внедрять цепочки reasoning, проверок и fallback-механизмов
- Диагностировать, где и почему ломается логика AI — не «плохой ответ», а почему система даёт такой ответ
- Ставить guardrails на необратимые действия агентов, определять условия выхода из циклов
RAG и данные:
- Строить end-to-end RAG-пайплайны: ingestion → chunking → embeddings → vector search + hybrid → reranking → prompt orchestration → grounding
- Экспериментировать с retrieval-стратегиями: гибридный поиск (BM25 + dense), re-ranking, query rewriting
- Организовывать пайплайн данных: сбор, нормализация, индексация, мониторинг
Качество и eval:
- Разрабатывать и внедрять методики оценки RAG-систем и AI-агентов: offline-метрики, golden datasets, LLM-as-a-Judge, human evaluation, A/B-тесты
- Выстраивать observability: логи, трейсы, мониторинг качества, версионирование промптов и датасетов
- Контролировать retrieval-метрики (Hit Rate, MRR, NDCG@K), groundedness, уровень галлюцинаций
Что мы от тебя ждем:
Обязательно:
- Опыта создания агентов на современных фреймворках (LangChain, LangGraph, LlamaIndex и тд)
- Знания стратегий планирования AI-агентов (ReAct, Plan-and-Execute, Reflection и др.)
- Сильный prompt engineering + chain/tool/function calling
- Опыта работы с векторными БД (Weaviate, Pinecone, Qdrant, Milvus и др.)
- Опыта оценки качества LLM-систем (RAGAS, DeepEval, LLM-as-a-Judge или аналоги)
- Понимания агентских протоколов (MCP, A2A и тд)
- Linux, Git, Docker, Python
Будет плюсом:
- Понимание атак на LLM (Prompt Injection, Jailbreaks) и защиты от них (Guardrails)
- Опыт дообучения моделей (LoRA/qLoRA) на специфических доменах
- Опыт квантизации и оптимизации инференса (ONNX, AWQ)
- Опыт с графовыми БД (Neo4j) и GraphRAG
- MLOps-инструменты: MLflow, Kubeflow, DVC
- Опыт с Kubernetes и высоконагруженными сервисами
Что мы предлагаем:
- Комфортный офис в Бизнес-центре "Алкон", расположенном рядом с метро Сокол
- График работы с 09:00 до 18:00 для поддержания баланса между работой и личной жизнью, а гибридный формат и ДМС ждет тебя после успешного прохождения испытательного срока
- Испытательный срок длительностью 3 месяца для взаимной адаптации
- Работа с современными технологиями и инструментами
- Сильную и дружную команду профессионалов, готовых расти вместе с вами.
- Скидки на всю нашу крутую продукцию!
Если ты готов к масштабному вызову, хочешь работать работать в команде, которая ценит профессионализм и инновации, — мы ждём тебя!
"Градиент" — там, где технологии становятся стратегией.