Ищем Data Scientist’а с опытом внедрения больших языковых моделей. Вы будете работать на стыке ML, бэкенда и продукта: от проектирования RAG и агентов до файн-тюнинга и оптимизации инференса.
Задачи:
Интеграция и RAG: Встраивание LLM в сервисы (API, пайплайны), создание агентных сценариев и RAG-систем (векторные БД, оптимизация поиска).
Обучение и инференс: Fine-tuning (PEFT, LoRA), работа с мультимодальными моделями, ускорение и удешевление инференса (квантизация, батчинг).
Качество и безопасность:
Оценка моделей (автометрики, human eval), внедрение guardrails, участие в архитектурных решениях.
Требования:
База: Высшее образование (IT/математика). Отличное знание Python и SQL, теория вероятностей, матстат, ML и NLP.
LLM-стек: Глубокое понимание архитектуры LLM. Опыт с Prompt Engineering, RAG, LangChain/LlamaIndex, Hugging Face.
Инженерия: Опыт деплоя (Docker, K8s, Cloud), работы с векторными БД и оптимизации инференса (vLLM, ONNX).
Будет плюсом:
Продуктовое мышление и понимание бизнес-метрик.
Pet-проекты, Open Source вклад, публикации или участие в хакатонах, связанные с LLM.
Мы предлагаем:
Формат работы: удаленный
Зарплатная плата обсуждается с успешным кандидатом