з/п не указана
Москва
не требуется
Задачи, которые будут в твоих руках:
Инфраструктура и сеть
- Проектирование и эксплуатация сетевого контура в AWS: VPC, подсети, route tables, NAT/IGW, Transit Gateway / VPC Peering, PrivateLink, Security Groups и NACL
- DNS (Route 53, приватные зоны, split-horizon), TLS и управление сертификатами, WAF, балансировщики (ALB/NLB), CDN
- Диагностика сетевых проблем «до конца»: MTU, TCP-таймауты, conntrack, DNS-latency, проблемы service mesh / CNI, а не «перезапустили под — помогло»
- Сетевые политики внутри кластера (NetworkPolicy, Cilium/Calico), ingress-контроллеры, egress-контроль
SRE и надёжность
- SLI/SLO/error budget на ключевые пользовательские сценарии; работа с продуктовыми командами над тем, чтобы бюджет ошибок реально влиял на приоритеты
- Observability: метрики, логи, трейсы. Алерты на симптомы, а не на каждый скачок CPU
- Управление инцидентами: on-call, эскалации, runbooks, blameless postmortem и доведение action items до закрытия
- Capacity planning, работа со стоимостью облака, нагрузочное тестирование, chaos-эксперименты
Базы данных (PostgreSQL)
- Эксплуатация PostgreSQL в production: RDS/Aurora и/или self-managed в Kubernetes (CloudNativePG, Patroni)
- Репликация, failover, HA-топология, connection pooling (PgBouncer/RDS Proxy)
- Тюнинг: разбор EXPLAIN ANALYZE, индексы, autovacuum и bloat, wraparound, long-running транзакции, блокировки
- Zero-downtime миграции схемы, версионирование миграций, ревью изменений схемы от продуктовых команд
- Бэкапы и восстановление: PITR, регулярные учебные restore-проверки, RPO/RTO как проверенные цифры, а не пункт в вики
GitOps и delivery
- Git как единственный источник истины: ArgoCD / Flux, декларативные окружения, прогрессивные деплои (canary, blue-green), автоматический откат
- Terraform (и/или Terragrunt, Pulumi, CDK): модули, стейт, drift detection, ревью плана как часть PR
- Helm / Kustomize, шаблонизация без копипаста между окружениями
- CI/CD: GitHub Actions / GitLab CI — быстрые, воспроизводимые пайплайны, кеширование, сборка контейнеров, supply-chain гигиена (подпись артефактов, сканирование, SBOM)
- Управление секретами: External Secrets / Vault / SOPS, ротация, отсутствие секретов в Git
Что для этого нужно:
- Профиль намеренно широкий: сеть, SRE-практики, эксплуатация PostgreSQL и GitOps
- Не ждём глубины senior-DBA и senior-network-инженера одновременно — но ждём, что вы уверенно работаете в каждом из этих доменов
- Умение самостоятельно докопаться до причины инцидента, на каком бы уровне стека она ни была
- Это не «поддержка CI» и не «дежурный по алертам» — роль про то, чтобы инфраструктура была описана кодом, изменения проходили через Git, а надёжность измерялась цифрами, а не ощущениями
Технологии, с которыми работаем
- Сеть/AWS: VPC, route tables, NAT/IGW, Transit Gateway, VPC Peering, PrivateLink, Security Groups, NACL, Route 53, TLS, WAF, ALB/NLB, CDN
- Kubernetes: NetworkPolicy, Cilium/Calico, ingress-контроллеры, CNI
- Observability: Prometheus/VictoriaMetrics, Grafana, Loki, Tempo/Jaeger, OpenTelemetry
- PostgreSQL: RDS/Aurora, CloudNativePG, Patroni, PgBouncer/RDS Proxy
- GitOps/IaC: ArgoCD/Flux, Terraform/Terragrunt/Pulumi/CDK, Helm/Kustomize
- CI/CD: GitHub Actions / GitLab CI
- Secrets: External Secrets, Vault, SOPS