Дата-инженер / DWH в Дзен

Дата размещения вакансии: 19.07.2026
Работодатель: VK
Уровень зарплаты:
з/п не указана
Город:
Москва
Садовническая улица 82с2
Требуемый опыт работы:
От 3 до 6 лет

Дзен является частью большой экосистемы VK. Это крупнейшая новостная платформа, где миллионы пользователей следят за событиями по всему миру. Здесь можно всё: смотреть новости, читать новости, обсуждать новости с ИИ-ассистентом Глифом или стать автором и самому создавать актуальный контент. Мы строим высоконагруженные сервисы и рекомендательные технологии, которые в реальном времени обрабатывают потоки информации и помогают пользователю получить максимально персональную ленту обо всём, что произошло в мире.

Дзен — это продукт, который: существует на рынке более 10 лет, охватывает 65 млн пользователей ежемесячно, растёт и развивается ежедневно — сейчас в Дзене более 100 000 активных авторов в неделю. Наш продукт ежедневно становится лучше благодаря сильной команде. Нас уже более 400 человек, мы работаем из 50 городов по всей стране и каждый день превращаем сложные вызовы в результаты.

Мы поставили себе амбициозную цель — стать крупнейшей новостной платформой страны, и ТЫ можешь помочь нам в этом! Развиваем DWH Дзена на YTsaurus: от слоёв хранилища и data quality до сервисов, которыми ежедневно пользуются аналитики и продуктовые команды.

Что делаем:

  • Хранилище: многослойная модель raw → ods → dds → cdm → stg → export со строгими соглашениями именования и data quality поверх ~120 пайплайнов с алертингом
  • Дата-продукты: каталог таблиц и трекинг SLA доезда данных (lineage/governance), кастомный планировщик workflow, бот-интерфейс к сервисам DWH
  • Работаем в монорепозитории (>1200 модулей-трансформаций) с автоматизированным code review через CI и дежурствами

Ищем инженера широкого профиля: данные + сервисы.

Задачи

  • Развивать внутренние продукты команды: проектировать и писать сервисы, API, интеграции
  • Проектировать и развивать модели данных по слоям хранилища
  • Писать и оптимизировать трансформации на YQL и Python
  • Поддерживать и расширять оркестрацию пайплайнов
  • Развивать мониторинг качества данных и реагировать на инциденты
  • Участвовать в ревью и поддерживать инженерную планку команды

Требования

  • Уверенный Python: production-код, сервисы, а не только скрипты
  • Крепкий SQL и понимание аналитических запросов и их оптимизации
  • Опыт проектирования и поддержки бэкенд-сервисов / API / интеграций
  • Понимание, как устроен слоёный DWH (модели данных, инкрементальная загрузка, партиционирование)
  • Аккуратность к качеству данных и к соглашениям (именование, технические поля)