Platform Engineer

Дата размещения вакансии: 21.08.2026
Работодатель: РобоФинанс
Уровень зарплаты:
з/п не указана
Город:
Москва
Требуемый опыт работы:
не требуется

Задачи, которые будут в твоих руках:

Инфраструктура и сеть

  • Проектирование и эксплуатация сетевого контура в AWS: VPC, подсети, route tables, NAT/IGW, Transit Gateway / VPC Peering, PrivateLink, Security Groups и NACL
  • DNS (Route 53, приватные зоны, split-horizon), TLS и управление сертификатами, WAF, балансировщики (ALB/NLB), CDN
  • Диагностика сетевых проблем «до конца»: MTU, TCP-таймауты, conntrack, DNS-latency, проблемы service mesh / CNI, а не «перезапустили под — помогло»
  • Сетевые политики внутри кластера (NetworkPolicy, Cilium/Calico), ingress-контроллеры, egress-контроль

SRE и надёжность

  • SLI/SLO/error budget на ключевые пользовательские сценарии; работа с продуктовыми командами над тем, чтобы бюджет ошибок реально влиял на приоритеты
  • Observability: метрики, логи, трейсы. Алерты на симптомы, а не на каждый скачок CPU
  • Управление инцидентами: on-call, эскалации, runbooks, blameless postmortem и доведение action items до закрытия
  • Capacity planning, работа со стоимостью облака, нагрузочное тестирование, chaos-эксперименты

Базы данных (PostgreSQL)

  • Эксплуатация PostgreSQL в production: RDS/Aurora и/или self-managed в Kubernetes (CloudNativePG, Patroni)
  • Репликация, failover, HA-топология, connection pooling (PgBouncer/RDS Proxy)
  • Тюнинг: разбор EXPLAIN ANALYZE, индексы, autovacuum и bloat, wraparound, long-running транзакции, блокировки
  • Zero-downtime миграции схемы, версионирование миграций, ревью изменений схемы от продуктовых команд
  • Бэкапы и восстановление: PITR, регулярные учебные restore-проверки, RPO/RTO как проверенные цифры, а не пункт в вики

GitOps и delivery

  • Git как единственный источник истины: ArgoCD / Flux, декларативные окружения, прогрессивные деплои (canary, blue-green), автоматический откат
  • Terraform (и/или Terragrunt, Pulumi, CDK): модули, стейт, drift detection, ревью плана как часть PR
  • Helm / Kustomize, шаблонизация без копипаста между окружениями
  • CI/CD: GitHub Actions / GitLab CI — быстрые, воспроизводимые пайплайны, кеширование, сборка контейнеров, supply-chain гигиена (подпись артефактов, сканирование, SBOM)
  • Управление секретами: External Secrets / Vault / SOPS, ротация, отсутствие секретов в Git

Что для этого нужно:

  • Профиль намеренно широкий: сеть, SRE-практики, эксплуатация PostgreSQL и GitOps
  • Не ждём глубины senior-DBA и senior-network-инженера одновременно — но ждём, что вы уверенно работаете в каждом из этих доменов
  • Умение самостоятельно докопаться до причины инцидента, на каком бы уровне стека она ни была
  • Это не «поддержка CI» и не «дежурный по алертам» — роль про то, чтобы инфраструктура была описана кодом, изменения проходили через Git, а надёжность измерялась цифрами, а не ощущениями

Технологии, с которыми работаем

  • Сеть/AWS: VPC, route tables, NAT/IGW, Transit Gateway, VPC Peering, PrivateLink, Security Groups, NACL, Route 53, TLS, WAF, ALB/NLB, CDN
  • Kubernetes: NetworkPolicy, Cilium/Calico, ingress-контроллеры, CNI
  • Observability: Prometheus/VictoriaMetrics, Grafana, Loki, Tempo/Jaeger, OpenTelemetry
  • PostgreSQL: RDS/Aurora, CloudNativePG, Patroni, PgBouncer/RDS Proxy
  • GitOps/IaC: ArgoCD/Flux, Terraform/Terragrunt/Pulumi/CDK, Helm/Kustomize
  • CI/CD: GitHub Actions / GitLab CI
  • Secrets: External Secrets, Vault, SOPS