В SberData мы создаём платформу данных для всего Сбера. Это более 350 источников данных и 100+ Пб информации, заказ и получение данных за 15 минут,а также современный технологический стек работы с данными, включая собственные сборки СУБД на базе Hadoop и Greenplum. Наша команда развивает инструменты и внедряет технологию разделённого Compute & Storage в рамках концепции Lakehouse. Наша задача — спроектировать и внедрить надёжное, безопасное решение для высоконагруженных расчётов витрин данных на современных технологиях Compute (Spark, Flink) и Storage (S3), работающее на 10 000+ серверах.
Ключевые обязанности
- развитие платформы Lakehouse на k8s — архитектурные решения, код-ревью, технические решения и обеспечение delivery, а также непосредственная разработка ключевых компонентов дата-платформы в Kubernetes
- техническое проектирование и спецификации — определение архитектуры системы, API-контрактов, интеграционных паттернов с инфраструктурной и security-командами
- оптимизация производительности дата-платформы — профилирование batch и streaming-сценариев, выявление узких мест, реализация стратегий тюнинга
- профилирование оборудования и планирование мощности — совместно с инфраструктурным подразделением на основе бенчмарков реальных нагрузок
- обеспечение безопасности и надёжности — внедрение практик InfoSec в CI/CD
- определение технической стратегии — оценка новых технологий, PoC, build-vs-buy решения
- менторство и развитие команды — код-ревью, Pair Programming, техническая экспертиза для членов команды.
Требования
- 7+ лет в разработке / DevOps
- 5+ лет работы с k8s в production — вы запускали рабочие нагрузки на масштабе, а не просто разворачивали кластер
- глубокая экспертиза в Spark и Ozone — вы запускали Spark on Kubernetes в production
- глубокое понимание распределённых систем — консистентность, fault tolerance, партиционирование, шардирование, репликация
- опыт работы с CI/CD, GitOps, infrastructure-as-code (Terraform / Ansible)
- хорошее понимание принципов информационной безопасности и reliability engineering (мониторинг, алертинг, инцидент-менеджмент).
Будет плюсом
- практический опыт с Lakehouse-архитектурой — Iceberg / Hudi / Delta Lake
- опыт эксплуатации аналитических БД: ClickHouse / StarRocks / Trino / Greenplum
- глубокое знание S3-хранилищ, HDFS, Hive Metastore
- опыт построения data-платформ на 1000+ серверов / large-scale нагрузок
- опыт работы с AI/ML нагрузками в Kubernetes — генеративные модели, AI-агенты, MLOps
- референсы технического лидерства — конференции, блог, open-source контрибуции.
Мы предлагаем
- комфортный современный офис в Москве: Бизнес-центр Чайка Плаза, рядом с М.Тульская, Верхние котлы
- гибридный формат работы: 4 дня офисе/1 - удаленно
- ежегодный пересмотр зарплаты, годовая премия
- корпоративный спортзал и зоны отдыха
- более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
- расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
- гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
- подписка Прайм с возможностью совместного использования на трёх близких
- вознаграждение за рекомендацию друзей в команду Сбера.