1-й Дербеневский переулок 5с2
Ищем системного администратора, который будет отвечать за стабильную работу серверной и сетевой инфраструктуры, а также участвовать в её развитии и автоматизации.
В работе — Linux и Windows Server, виртуализация на Proxmox, сети и VPN, мониторинг, резервное копирование, RabbitMQ и PostgreSQL.
Важная часть роли — не только поддерживать инфраструктуру, но и разбираться в причинах инцидентов, автоматизировать рутинные задачи и улучшать существующие решения.
Чем предстоит заниматься:
Серверная инфраструктура и виртуализация
- Развёртывать, настраивать и сопровождать инфраструктуру виртуализации на базе Proxmox.
- Создавать, настраивать, мигрировать и удалять виртуальные машины и LXC-контейнеры.
- Управлять ресурсами виртуальной среды: CPU, RAM, дисковым пространством и сетевыми интерфейсами.
- Настраивать сетевую связность и изоляцию виртуальных сред.
- Участвовать в сборке, модернизации и диагностике серверов и рабочих станций.
Linux и Windows Server
- Устанавливать, настраивать и администрировать Linux-серверы (преимущественно Debian/Ubuntu).
- Администрировать Windows Server 2016/2019/2022.
- Работать с пользователями, группами, правами доступа, файловыми системами, сетевыми настройками, firewall и маршрутизацией.
Сети и удалённый доступ
- Настраивать и сопровождать VPN: L2TP/IPsec, WireGuard.
- Работать с сетевым и серверным оборудованием.
- Диагностировать проблемы сетевой связности и доступности сервисов.
Мониторинг и автоматизация
- Разворачивать и сопровождать системы мониторинга.
- Настраивать дашборды, метрики и алерты.
- Контролировать состояние физических серверов, виртуальных машин, контейнеров и ключевых сервисов.
- Автоматизировать реакции на типовые события и рутинные операции.
- Использовать Ansible, runbooks и интеграции с почтовыми системами/мессенджерами для автоматизации.
Сервисы и прикладное ПО
- Разворачивать и сопровождать веб-серверы, почтовые системы, каталоги и другие инфраструктурные сервисы.
- Администрировать RabbitMQ: установка, базовая настройка, мониторинг очередей, диагностика сбоев и восстановление работоспособности.
Базы данных и резервное копирование
- Администрировать PostgreSQL: установка, настройка, резервное копирование и восстановление, базовый мониторинг производительности.
- Организовывать и сопровождать резервное копирование виртуальных машин, контейнеров и серверов.
- Контролировать успешность выполнения бэкапов и участвовать в восстановлении при необходимости.
Инциденты и развитие инфраструктуры
- Участвовать в расследовании инцидентов и проводить анализ первопричин (Root Cause Analysis).
- Вырабатывать меры для предотвращения повторных сбоев.
- Взаимодействовать с технической поддержкой производителей программного и аппаратного обеспечения.
- Участвовать в проектах по внедрению, модернизации и развитию ИТ-инфраструктуры.
- Поддерживать специалистов заказчика по вопросам серверного и сетевого оборудования.
- Периодически выезжать на площадки заказчиков для диагностики, настройки и модернизации оборудования. Продолжительность выездов — обычно 1–3 дня.
Документация
- Вести эксплуатационную документацию: инструкции, регламенты, памятки, отчёты и статьи для корпоративной wiki.
- Описывать типовые процедуры и решения, поддерживать актуальность технической документации.
Что мы ожидаем:
- Опыт работы системным администратором или серверным инженером от 2 лет.
- Уверенное администрирование Linux (Debian/Ubuntu).
- Уверенное администрирование Windows Server 2016/2019/2022.
- Понимание принципов виртуализации и опыт работы с Proxmox будет большим преимуществом.
- Понимание сетевых технологий и практический опыт настройки VPN (L2TP/IPsec, WireGuard).
- Понимание принципов работы RabbitMQ: установка, базовая конфигурация, мониторинг очередей, диагностика проблем.
- Опыт работы с PostgreSQL на уровне администрирования будет преимуществом.
- Понимание принципов резервного копирования и восстановления.
- Опыт работы с системами мониторинга и автоматизацией инфраструктурных задач.
- Английский язык на уровне чтения технической документации, статей и логов. Допускается использование переводчиков.
- Умение понятно объяснять технические вопросы коллегам и заказчикам, грамотно вести документацию.
- Готовность к периодическим командировкам продолжительностью 1–3 дня.
- Готовность при необходимости участвовать в дежурствах и подключаться к решению критических инцидентов вне стандартного рабочего времени.
Будет плюсом:
- Опыт работы с Proxmox на уровне самостоятельного администрирования.
- Практический опыт работы с Ansible.
- Опыт построения и сопровождения систем мониторинга.
- Опыт работы с серверным и сетевым оборудованием.
- Опыт диагностики сложных инфраструктурных инцидентов.
- Опыт работы с PostgreSQL, RabbitMQ и другими middleware-сервисами.
Условия:
- Оформление по ТК РФ с первого рабочего дня.
- Конкурентная заработная плата (обсуждается индивидуально).
- Полностью белая заработная плата.
- Оплачиваемые отпуск и больничные.
- График 9:00–18:00 (возможен сдвиг до 10:00–19:00).
- Работа в офисе на время испытательного срока, далее гибрид (3 дня офис, 2 удаленно).
- Компенсация необходимых обучений.