з/п не указана
Москва
проспект Андропова 18к1
проспект Андропова 18к1
От 3 до 6 лет
МТС Банк развивает цифровые финансовые сервисы и делает их доступными для всех.
Мы работаем с современным технологическим стеком, высоконагруженными системами и облачной инфраструктурой. Такой подход позволяет создавать надёжные решения для бизнеса и клиентов.
Мы в поиске Старшего администратора комплекса мониторинга в Ситуационный центр.
Чем предстоит заниматься:
- администрировать и оптимизировать стек мониторинга (Zabbix, VictoriaMetrics, Grafana) и логирования (ELK)
- настраивать и поддерживать балансировщики (Nginx, HAProxy) и отказоустойчивые кластеры (Keepalived, VRRP) в рамках систем мониторинга
- вести GitLab-репозитории с плейбуками развёртывания сервисов и конфигураций
- настраивать CI/CD пайплайны для автоматического применения изменений (GitOps-подход)
- работать с Docker и Docker Swarm: сборка образов, деплой сервисов, rolling update, откаты
- разрабатывать и поддерживать процедуры Disaster Recovery (DRP) и документацию по восстановлению (DRT)
- обеспечивать бесперебойную работу сервисов и быстрое реагирование на инциденты
Наши пожелания к кандидату:
- глубокие знания RHEL/CentOS/Debian на уровне Senior: управление процессами, памятью, файловыми системами, systemd, сеть (маршрутизация, iptables/nftables, tcpdump), диагностика и troubleshooting (strace, perf, dmesg, journalctl), скриптинг (Bash/Python)
- мониторинг: экспертиза в Zabbix (шаблоны, LLD, триггеры) и VictoriaMetrics (MetricsQL/PromQL, кластеризация)
- визуализация: экспертиза в построении дашбордов и алертинга в Grafana
- логи: опыт работы с ELK (Elasticsearch, Logstash, Kibana), пайплайны, ILM
- балансировка и отказоустойчивость: опыт работы с Nginx, HAProxy, Keepalived
- контейнеризация: опыт работы с Docker (Dockerfile, compose), Docker Swarm (сервисы, стеки, overlay-сети, секреты)
- CI/CD: опыт настройки пайплайнов в GitLab CI для деплоя сервисов и управления конфигами (GitOps), понимание принципов версионирования инфраструктуры в Git
- DRP/DRT: понимание принципов Disaster Recovery, опыт проведения DRT