з/п не указана
Москва
От 3 до 6 лет
Мы находимся в поиске Data Engineera в платформенную команду BI.
Команда занимается развитием корпоративного хранилища данных (DataLake). Исследует и внедряет новые инструменты (RnD), пишет библиотеки для использования другими командами, разрабатывает нестандартные ETL потоки и помогает коллегам в оптимизации сложных потоков.
Обязанности:
- Реализация ETL в Hadoop (с помощью Airflow);
- Работа с различными источниками данных: Oracle MS SQL API личных кабинетов, микросервисы;
- Батч и стримы с помощью PySpark и Kafka;
- Подготовка витрин для анализа (Hive + Spark+ SQL).
Требования:
- Уверенное владение Python;
- Опыт использования эко-системы Hadoop: HDFS, Apache AirFlow, Hive, Kafka,Spark;
- Знание SQL;
- Опыт работы с реляционными базами данных (Oracle).
Наш стек: Kafka, Spark, Airflow, Jira, Confluence, GitLab.