з/п не указана
Москва
От 3 до 6 лет
Мы ищет инженера по внедрению и оптимизации больших языковых моделей. Специалист, который поможет превратить передовые достижения в области GenAI в надежные, масштабируемые и экономически эффективные enterprise-решения.
Чем предстоит заниматься:
- Интегрировать LLM в enterprise-процессы: RAG, агентные архитектуры, fine-tuning pipelines, human-in-the-loop сценарии.
- Проводить техническое исследование новых подходов и фреймворков для эффективной эксплуатации LLM в production.
- Оптимизировать производительность моделей: latency, throughput, cost-efficiency (quantization, distillation, speculative decoding и др.).
Для нас важно:
- Опыт работы с LLM (инференс, дообучение, fine-tuning, RAG и пр.) не менее 3-х лет.
- Уверенное владение Python и основными ML-библиотеками (PyTorch, Transformers, accelerate и т.п.).
- Опыт проектирования LLM-агентов или production-систем на их основе (LangChain, LangGraph и т.п.).
- Опыт вывода решений на основе LLM в пром (vLLM, SGLang).
Главный принцип SkillStaff - Выбирай!
- РАЗНООБРАЗИЕ ПРОЕКТОВ. Выбирай из сотен компаний и проектов то, что интересно и полезно для твоего роста. SkillStaff помогает реализовывать ежегодно порядка 500 различных ИТ-проектов для крупного бизнеса.
- КОМФОРТ. SkillStaff — аккредитованная IT-компания, белая зарплата и удобный график работы. Создавай идеальные условия для своей работы: удаленная работа или возможность работать как в офисе клиента, так и в комфортном офисе SkillStaff в центре Москвы на Воздвиженке.
- РАЗВИТИЕ. Выбирай сам путь, по которому ты хочешь развиваться. Используй возможность обмена опытом и получение знаний через участие в разных проектах, совместную работу с высококвалифицированными коллегами.
- КУЛЬТУРА. Нашу культуру создают сами сотрудники – мы их слышим и помогаем развиваться, чтобы #вместе переходить на новый уровень!