ОТР 2000 - крупная ИТ-компания с более, чем 25-летней историей реализации масштабных проектов разработки, внедрения и сопровождения ПО для банков, федеральных ведомств и коммерческих организаций.
Наша команда уже разработала и внедрила свыше 3 000 сложнейших, неординарных социально-значимых ИТ-проектов, которые каждый день делают жизнь российских граждан удобной и комфортной.
Через наши системы проходит более 5 млн. операций в день. Все это позволяет компании быть стабильной и развивающейся на протяжении уже более 25 лет.
Мы ищем специалиста, который будет отвечать за эксплуатацию и сопровождение контейнеризированных приложений в Kubernetes-кластере на базе Deckhouse, а также за мониторинг, диагностику и устранение проблем в инфраструктуре и микросервисных приложениях.
Основные задачи:
- Администрирование и сопровождение Kubernetes-кластеров на базе Deckhouse.
- Управление namespace, ресурсными квотами и политиками безопасности.
- Работа с RBAC и NetworkPolicy.
- Работа с Helm-чартами: установка, настройка и обновление приложений.
- Мониторинг состояния кластера и приложений.
- Анализ метрик, графиков нагрузки и алертов в Prometheus и Grafana.
- Анализ логов приложений и инфраструктурных компонентов, выявление причин сбоев и деградации производительности.
- Диагностика проблем взаимодействия между микросервисами.
- Сопровождение Java-приложений, работающих в контейнерах.
- Анализ JVM-параметров, потребления памяти, работы GC и поведения приложений под нагрузкой.
- Анализ thread dump и heap dump при возникновении проблем с производительностью или памятью.
- Взаимодействие с CI/CD и инфраструктурными компонентами.
Обязательные требования:
Kubernetes / Deckhouse
- Практический опыт администрирования Deckhouse.
- Понимание архитектуры Kubernetes-кластера: control plane, etcd, сетевые плагины и основные компоненты.
- Опыт работы с namespace и resource quotas.
- Понимание и практический опыт применения RBAC и NetworkPolicy.
- Работа с Helm-чартами: установка, настройка и обновление приложений. Доработка чартов
- Опыт работы с контейнеризацией (Docker, Containerd)
- Опыт автоматизации типовых задач на Bash, Ansible (без ИИ)
- Опыт работы с ModuleConfig, включение/отключение модулей и настройку их параметров
- Опыт настройки и управления хранилищами в Kubernetes (StorageClass, PersistentVolume, PersistentVolumeClaim
Мониторинг и диагностика
- Опыт работы с Prometheus и Grafana.
- Умение анализировать метрики, графики нагрузки и алерты.
- Понимание влияния инфраструктурных и прикладных проблем на работу системы.
- Умение самостоятельно читать и анализировать логи.
- Системный подход к troubleshooting: от симптома к локализации и устранению причины.
Инструменты и технологии
Практический опыт работы с:
- GitLab;
- Nexus;
- Apache NiFi;
- Apache Kafka;
- Redis;
- Nginx;
Java в Kubernetes
- Опыт эксплуатации Java-приложений в контейнерах.
- Понимание JVM и основных параметров:
- Heap;
- Metaspace;
- Garbage Collector;
- ограничения памяти контейнера.
- Умение анализировать thread dump.
- Умение анализировать heap dump.
- Понимание типовых проблем Java-приложений: OOM, утечки памяти, чрезмерная нагрузка на GC, зависание потоков и деградация производительности.
Будет преимуществом:
- Опыт работы с PostgreSQL.
- Опыт работы с ClickHouse.
- Глубокое понимание HTTP: методы, заголовки, коды ответов, таймауты.
- Опыт диагностики взаимодействия микросервисов с помощью:
- curl;
- grpcurl;
- kubectl port-forward.
- Понимание механизмов аутентификации: токены, cookies, Authorization headers.
- Опыт настройки Ingress-контроллеров.
- Понимание TLS и работы сертификатов.
- Навыки диагностики DNS, балансировки нагрузки и сетевых таймаутов.
- Понимание микросервисных паттернов:
- Service Discovery;
- API Gateway;
- Circuit Breaker.
- Опыт работы с распределённой трассировкой и Jaeger.
Что мы предлагаем:
- Возможность принять участие в социально-значимых проектах федерального масштаба, перенимая экспертизу у настоящих профи;
- Все льготы и преимущества работы в аккредитованной ИТ-компании;
- Система наставничества на время адаптации и поддержка в профессиональном развитии;
- Долгосрочные проекты и возможность перехода в другие команды;
- Доверие к сотрудникам и отсутствие микроменеджмента;
- Приятные бонусы - корпоративные скидки в SkyEng, СИТИЛИНК, xFit, оплата обучения и другие льготы в составе гибкого соцпакета.