DevOps / Kubernetes-инженер (Deckhouse)

Дата размещения вакансии: 17.08.2026
Работодатель: ОТР
Уровень зарплаты:
з/п не указана
Город:
Нижний Новгород
Требуемый опыт работы:
От 3 до 6 лет

ОТР 2000 - крупная ИТ-компания с более, чем 25-летней историей реализации масштабных проектов разработки, внедрения и сопровождения ПО для банков, федеральных ведомств и коммерческих организаций.

Наша команда уже разработала и внедрила свыше 3 000 сложнейших, неординарных социально-значимых ИТ-проектов, которые каждый день делают жизнь российских граждан удобной и комфортной.

Через наши системы проходит более 5 млн. операций в день. Все это позволяет компании быть стабильной и развивающейся на протяжении уже более 25 лет.

Мы ищем специалиста, который будет отвечать за эксплуатацию и сопровождение контейнеризированных приложений в Kubernetes-кластере на базе Deckhouse, а также за мониторинг, диагностику и устранение проблем в инфраструктуре и микросервисных приложениях.

​​​​​Основные задачи:

  • Администрирование и сопровождение Kubernetes-кластеров на базе Deckhouse.
  • Управление namespace, ресурсными квотами и политиками безопасности.
  • Работа с RBAC и NetworkPolicy.
  • Работа с Helm-чартами: установка, настройка и обновление приложений.
  • Мониторинг состояния кластера и приложений.
  • Анализ метрик, графиков нагрузки и алертов в Prometheus и Grafana.
  • Анализ логов приложений и инфраструктурных компонентов, выявление причин сбоев и деградации производительности.
  • Диагностика проблем взаимодействия между микросервисами.
  • Сопровождение Java-приложений, работающих в контейнерах.
  • Анализ JVM-параметров, потребления памяти, работы GC и поведения приложений под нагрузкой.
  • Анализ thread dump и heap dump при возникновении проблем с производительностью или памятью.
  • Взаимодействие с CI/CD и инфраструктурными компонентами.

Обязательные требования:

Kubernetes / Deckhouse

  • Практический опыт администрирования Deckhouse.
  • Понимание архитектуры Kubernetes-кластера: control plane, etcd, сетевые плагины и основные компоненты.
  • Опыт работы с namespace и resource quotas.
  • Понимание и практический опыт применения RBAC и NetworkPolicy.
  • Работа с Helm-чартами: установка, настройка и обновление приложений. Доработка чартов
  • Опыт работы с контейнеризацией (Docker, Containerd)
  • Опыт автоматизации типовых задач на Bash, Ansible (без ИИ)
  • Опыт работы с ModuleConfig, включение/отключение модулей и настройку их параметров
  • Опыт настройки и управления хранилищами в Kubernetes (StorageClass, PersistentVolume, PersistentVolumeClaim

Мониторинг и диагностика

  • Опыт работы с Prometheus и Grafana.
  • Умение анализировать метрики, графики нагрузки и алерты.
  • Понимание влияния инфраструктурных и прикладных проблем на работу системы.
  • Умение самостоятельно читать и анализировать логи.
  • Системный подход к troubleshooting: от симптома к локализации и устранению причины.

Инструменты и технологии

Практический опыт работы с:

  • GitLab;
  • Nexus;
  • Apache NiFi;
  • Apache Kafka;
  • Redis;
  • Nginx;

Java в Kubernetes

  • Опыт эксплуатации Java-приложений в контейнерах.
  • Понимание JVM и основных параметров:
    • Heap;
    • Metaspace;
    • Garbage Collector;
    • ограничения памяти контейнера.
  • Умение анализировать thread dump.
  • Умение анализировать heap dump.
  • Понимание типовых проблем Java-приложений: OOM, утечки памяти, чрезмерная нагрузка на GC, зависание потоков и деградация производительности.

Будет преимуществом:

  • Опыт работы с PostgreSQL.
  • Опыт работы с ClickHouse.
  • Глубокое понимание HTTP: методы, заголовки, коды ответов, таймауты.
  • Опыт диагностики взаимодействия микросервисов с помощью:
    • curl;
    • grpcurl;
    • kubectl port-forward.
  • Понимание механизмов аутентификации: токены, cookies, Authorization headers.
  • Опыт настройки Ingress-контроллеров.
  • Понимание TLS и работы сертификатов.
  • Навыки диагностики DNS, балансировки нагрузки и сетевых таймаутов.
  • Понимание микросервисных паттернов:
    • Service Discovery;
    • API Gateway;
    • Circuit Breaker.
  • Опыт работы с распределённой трассировкой и Jaeger.

Что мы предлагаем:

  • Возможность принять участие в социально-значимых проектах федерального масштаба, перенимая экспертизу у настоящих профи;
  • Все льготы и преимущества работы в аккредитованной ИТ-компании;
  • Система наставничества на время адаптации и поддержка в профессиональном развитии;
  • Долгосрочные проекты и возможность перехода в другие команды;
  • Доверие к сотрудникам и отсутствие микроменеджмента;
  • Приятные бонусы - корпоративные скидки в SkyEng, СИТИЛИНК, xFit, оплата обучения и другие льготы в составе гибкого соцпакета.