з/п не указана
Москва
Более 6 лет
Привет! Это команда "Модерация селлерского контента"
Наша команда отвечает за автоматическую модерацию селлерского контента, обеспечивая его соответствие законодательству РФ и правилам маркетплейса. Много работаем с изображениями и текстами, используем современные подходы из NLP, CV и Multi-modal ML, а также активно внедряем их в production.
Сейчас мы ищем Senior Data Scientist, который усилит нас в задачах компьютерного зрения и обработки естественного языка.
Вы будете
- Участвовать в составлении роадмапа разработки, проводить ресерч и формулировать гипотезы для решения задач;
- Заниматься полным циклом разработки моделей автомодерации контента;
- Работать с multi-modal данными: изображениями, текстами и таблицами;
- Разрабатывать эффективный и воспроизводимый код для обучения моделей;
- Оптимизировать модели, ускорять inference и улучшать бизнес-метрики;
- Делиться опытом с другими участниками команды, участвовать в код-ревью;
- Взаимодействовать с аналитиками, продактами и разработчиками сервисов.
Нам важно
- Уверенное знание Python и опыт разработки на нём;
- Понимание алгоритмов и структур данных на уровне задач LeetCode Medium и выше;
- Практический опыт работы с PyTorch;
- Знание математической статистики, линейной алгебры и теории вероятностей;
- Отличные знания в области машинного обучения: классический ML и DL, способность объяснить принципы работы алгоритмов и выбрать подходящий для задачи;
- Практический опыт работы в задачах NLP и/или CV, знание современных архитектур (Transformers, CLIP и др.);
- Понимание принципов работы с большими данными, знакомство с такими инструментами как Hadoop, Spark, Airflow, SQL;
- Опыт ведения проектов: принятие технических решений, декомпозиция и распределение задач, координации разработки.
Будет плюсом
- Опыт работы с NVIDIA Triton Inference Server;
- Навыки оптимизации и ускорения нейросетей (ONNX, TensorRT, quantization и т.д.).