Старший администратор комплекса мониторинга

Дата размещения вакансии: 06.10.2026
Работодатель: МТС Банк
Уровень зарплаты:
з/п не указана
Город:
Москва
проспект Андропова 18к1
Требуемый опыт работы:
От 3 до 6 лет

МТС Банк развивает цифровые финансовые сервисы и делает их доступными для всех.

Мы работаем с современным технологическим стеком, высоконагруженными системами и облачной инфраструктурой. Такой подход позволяет создавать надёжные решения для бизнеса и клиентов.

Мы в поиске Старшего администратора комплекса мониторинга в Ситуационный центр.

Чем предстоит заниматься:

  • администрировать и оптимизировать стек мониторинга (Zabbix, VictoriaMetrics, Grafana) и логирования (ELK)
  • настраивать и поддерживать балансировщики (Nginx, HAProxy) и отказоустойчивые кластеры (Keepalived, VRRP) в рамках систем мониторинга
  • вести GitLab-репозитории с плейбуками развёртывания сервисов и конфигураций
  • настраивать CI/CD пайплайны для автоматического применения изменений (GitOps-подход)
  • работать с Docker и Docker Swarm: сборка образов, деплой сервисов, rolling update, откаты
  • разрабатывать и поддерживать процедуры Disaster Recovery (DRP) и документацию по восстановлению (DRT)
  • обеспечивать бесперебойную работу сервисов и быстрое реагирование на инциденты

Наши пожелания к кандидату:

  • глубокие знания RHEL/CentOS/Debian на уровне Senior: управление процессами, памятью, файловыми системами, systemd, сеть (маршрутизация, iptables/nftables, tcpdump), диагностика и troubleshooting (strace, perf, dmesg, journalctl), скриптинг (Bash/Python)
  • мониторинг: экспертиза в Zabbix (шаблоны, LLD, триггеры) и VictoriaMetrics (MetricsQL/PromQL, кластеризация)
  • визуализация: экспертиза в построении дашбордов и алертинга в Grafana
  • логи: опыт работы с ELK (Elasticsearch, Logstash, Kibana), пайплайны, ILM
  • балансировка и отказоустойчивость: опыт работы с Nginx, HAProxy, Keepalived
  • контейнеризация: опыт работы с Docker (Dockerfile, compose), Docker Swarm (сервисы, стеки, overlay-сети, секреты)
  • CI/CD: опыт настройки пайплайнов в GitLab CI для деплоя сервисов и управления конфигами (GitOps), понимание принципов версионирования инфраструктуры в Git
  • DRP/DRT: понимание принципов Disaster Recovery, опыт проведения DRT