Применяет алгоритмическое мышление к DevOps: алгоритмы планирования деплоя для zero-downtime релизов, алгоритмы разрешения зависимостей пайплайнов, алгоритмы кэширования артефактов для ускорения сборки. Проектирует эффективные алгоритмы выделения ресурсов для масштабирования CI/CD-инфраструктуры.
Роли · DevOps Engineer · Senior
Что должен уметь Senior }
46 ключевых навыков, всего 63. Ожидания по каждому навыку и что меняется на следующем уровне.
На этой странице — что ожидается от Senior }, навык за навыком. Ключевые навыки оценивают руководитель и коллеги в цикле ревью; остальные учитываются только в самооценке. Основные области: Основы программирования, Backend Development, Базы данных.
Ключевые навыки для Senior
Сгруппированы по областям. Метка справа — ожидаемая глубина: Осведомлённость, Применение, Продвинутый или Эксперт.
Основы программирования · 5
Проектирует async-архитектуры для DevOps-автоматизации: конкурентные операции инфраструктуры в масштабе, async-оркестрация деплоев с поддержкой rollback, неблокирующая агрегация данных мониторинга. Менторит команду по async-паттернам для операционного инструментария.
Проектирует стандарты качества кода для DevOps-инструментария: структура CI/CD-пайплайнов, лучшие практики shell-скриптов, code style для configuration management. Рефакторит сложные скрипты деплоя в модульную, тестируемую автоматизацию. Устанавливает практики ревью для надёжности пайплайнов, управления секретами и воспроизводимости инфраструктуры.
Применяет ООП/SOLID в DevOps-инструментарии: абстрактные интерфейсы для абстракции облачных провайдеров, strategy pattern для стратегий деплоя (blue-green, canary), template method для стандартизированных стадий пайплайна. Проектирует расширяемые фреймворки автоматизации по dependency inversion для тестируемого кода инфраструктуры.
Выбирает оптимальные структуры данных для DevOps-инструментов: направленные ациклические графы для зависимостей CI/CD-пайплайнов, древовидные структуры для управления иерархией конфигурации, key-value хранилища для состояния деплоя. Оптимизирует структуры хранения артефактов и кэширования для ускорения сборки. Проектирует эффективные модели данных для инвентаризации инфраструктуры и отслеживания изменений.
Backend Development · 3
Деплоит и поддерживает Kafka-кластеры в Kubernetes: настройка Strimzi-оператора, управление топиками и партициями, мониторинг через JMX-метрики в Prometheus. Обеспечивает надёжную потоковую обработку событий инфраструктуры и CI/CD.
Разрабатывает внутренние DevOps-инструменты на Flask/FastAPI: дашборды состояния инфраструктуры, API для управления деплоями, webhook-обработчики для CI/CD-событий. Интегрирует с Kubernetes API и облачными SDK через асинхронные эндпоинты.
Деплоит и управляет Redis-кластерами для DevOps-нужд: кэширование результатов CI/CD, хранение сессий self-service порталов, pub/sub для real-time уведомлений. Настраивает Redis Sentinel для высокой доступности, мониторит через Prometheus-экспортер.
Базы данных · 1
Проектирует отказоустойчивые PostgreSQL-кластеры: Patroni для автоматического failover, PgBouncer для пулинга соединений, WAL-архивирование в S3. Автоматизирует миграции в CI/CD, настраивает мониторинг через PostgreSQL-экспортер в Prometheus.
API и интеграции · 1
Проектирует API для внутренних DevOps-инструментов: эндпоинты управления деплоями, API для self-service инфраструктуры, интеграции между системами мониторинга. Реализует аутентификацию через API-ключи и OAuth, версионирование и rate limiting.
Облако и инфраструктура · 12
Проектирует архитектуру балансировки для production: мульти-уровневая LB (Global → Regional → Pod), GSLB для geo-распределения, circuit breaking. Настраивает advanced routing через Istio/Envoy, оптимизирует для latency и throughput.
Проектирует сетевую архитектуру для production: Transit Gateway для multi-VPC, VPN и Direct Connect, DNS-стратегии для failover. Настраивает Calico/Cilium в Kubernetes для advanced networking, внедряет network policies и eBPF-мониторинг трафика.
Проектирует комплексную систему безопасности контейнеров: сканирование на всех этапах (build, registry, runtime), интеграция с Kubernetes admission controllers. Внедряет runtime security через Falco, настраивает автоматический патчинг base-образов.
Проектирует архитектуру автоматизации Ansible для DevOps-процессов на уровне организации — rolling-деплои, обновления с нулевым простоем и процедуры disaster recovery. Внедряет продвинутые паттерны с кастомными модулями, callback-плагинами и Ansible Tower/AWX для планируемой автоматизации и самообслуживающихся операций. Оптимизирует выполнение в масштабе через strategy-плагины, ускорение mitogen и эффективные паттерны сбора фактов для крупных инвентарей.
Проектирует production-архитектуру на AWS: multi-AZ развёртывания, EKS с Fargate и Karpenter, сложные VPC-топологии с Transit Gateway. Оптимизирует стоимость через Reserved Instances, Savings Plans и Spot-стратегии. Настраивает AWS Organizations и SCPs.
Проектирует CDN-архитектуру для production: мульти-CDN стратегия, intelligent routing, edge computing для API. Оптимизирует глобальную доставку контента, настраивает WAF и DDoS-защиту на edge, автоматизирует конфигурацию через Terraform.
Проектирует стратегию контейнеризации: стандартные base-образы организации, rootless-контейнеры, distroless-финальные образы. Оптимизирует слои для максимального кэширования, настраивает сканирование Trivy/Snyk в пайплайнах. Внедряет Docker Content Trust и подпись образов.
Проектирует библиотечные Helm-чарты для унификации деплоев: общие шаблоны для всех микросервисов, встроенные best practices (security contexts, resource limits, probes). Внедряет Helmfile для управления множеством релизов, тестирует чарты через helm test и ct.
Проектирует архитектуру production-кластеров: multi-tenancy через namespace-ы и RBAC, service mesh (Istio/Linkerd), custom controllers. Настраивает cluster autoscaler, оптимизирует ресурсы через VPA и Goldilocks. Внедряет GitOps для управления кластерами.
Проектирует production-ready Kubernetes-деплои: стратегии обновления (rolling, blue-green), настройка PDB и disruption budgets, мониторинг через kube-state-metrics. Управляет lifecycle приложений от разработки до production через GitOps-подход.
Проектирует масштабируемую Terraform-инфраструктуру: модульная архитектура для 50+ сервисов, Terragrunt для DRY-конфигураций, custom providers. Внедряет policy-as-code через Sentinel/OPA, автоматизирует drift detection и remediation в CI/CD-пайплайнах.
Проектирует VPN-инфраструктуру для production: redundant site-to-site VPN с BGP, Direct Connect/ExpressRoute как primary с VPN failover. Внедряет zero-trust альтернативы (Tailscale, Boundary), настраивает мониторинг и автоматический failover туннелей.
DevOps и CI/CD · 8
Проектирует архитектуру платформы ArgoCD для внедрения GitOps на уровне организации с мультикластерным управлением. Внедряет продвинутые паттерны, включая App of Apps, progressive delivery с Argo Rollouts и кастомные health checks для сложных нагрузок. Оптимизирует ArgoCD в масштабе с шардированием, кэшированием ресурсов и конфигурациями контроллеров высокой доступности.
Проектирует blue-green стратегию для production: автоматизированное переключение с pre/post-deployment hooks, интеграция с мониторингом для автоматического rollback. Решает проблемы database migrations, session management и cache invalidation при переключении.
Проектирует canary deployment платформу: Argo Rollouts с analysis templates, Prometheus-метрики для автоматической promotion/rollback. Внедряет flagger для service mesh-based canary, настраивает custom metrics и webhook анализаторы.
Проектирует стратегию feature management: архитектура для progressive delivery с флагами, интеграция с ArgoCD/Argo Rollouts. Внедряет canary releases через процентные флаги, настраивает observability для оценки влияния фич на метрики.
Проектирует масштабируемую CI/CD-платформу на GitHub Actions: self-hosted runners на Kubernetes (ARC), custom actions для организации, OIDC-интеграция с облаками. Оптимизирует время выполнения через кэширование, параллелизм и condition-based execution.
Проектирует CI/CD-платформу на GitLab: shared pipeline templates для организации, dynamic child pipelines, DAG-оптимизация. Настраивает GitLab Runner autoscaling на Kubernetes, интегрирует с Vault для секретов, внедряет compliance pipelines.
Проектирует GitOps архитектуру: определяет multi-environment promotion strategy (dev → staging → prod через Git), настраивает progressive delivery (canary/blue-green) через Argo Rollouts, реализует drift detection и auto-remediation. Проектирует RBAC для GitOps с team-scoped access.
Проектирует CI/CD архитектуру с Jenkins. Оптимизирует скорость и надёжность пайплайнов. Внедряет progressive delivery.
Тестирование и QA · 1
Проектирует программу chaos engineering: определяет steady-state metrics, проектирует эксперименты с нарастающей сложностью (single pod → availability zone → region), настраивает automated chaos runs в CI/CD. Интегрирует результаты с SLO/SLI мониторингом для выявления слабых мест.
Безопасность · 2
Проектирует DevSecOps-пайплайны: автоматическое сканирование на всех этапах CI/CD, policy-as-code через OPA/Gatekeeper, compliance-проверки инфраструктуры. Внедряет shift-left безопасность, настраивает SBOM-генерацию и vulnerability management.
Проектирует архитектуру управления секретами: Vault-кластер в HA-режиме, автоматическая ротация сертификатов и паролей, динамические секреты для БД и облаков. Внедряет Vault Agent Injector в Kubernetes, настраивает audit logging.
AI-ассистированная разработка · 1
Оптимизирует использование Copilot для инфраструктурного кода: тонкая настройка контекста для точных подсказок IaC, создание custom instructions для DevOps-паттернов. Автоматизирует code review с Copilot, интегрирует в пайплайны проверки качества.
Архитектура и проектирование · 2
Проектирует инфраструктуру для высоконагруженных систем: multi-tier архитектура с auto-scaling, event-driven микросервисы, CQRS для отделения read/write нагрузок. Проводит capacity planning, определяет SLO/SLI и проектирует для заданной надёжности.
Проектирует DR-архитектуру: multi-region active-passive и active-active конфигурации, автоматический failover с DNS. Внедряет chaos engineering (Chaos Monkey, Litmus) для валидации DR. Определяет RPO/RTO для каждого сервиса, автоматизирует DR-тестирование.
Observability и мониторинг · 7
Проектирует систему custom metrics: DORA-метрики для оценки delivery performance, SLI-метрики для каждого сервиса, бизнес-KPI в Prometheus. Внедряет OpenTelemetry Metrics, разрабатывает custom collectors для нестандартных источников.
Проектирует logging-стандарты организации: единая схема логирования, semantic conventions (OpenTelemetry), автоматическое обогащение контекстом. Внедряет distributed tracing correlation, настраивает sampling для высоконагруженных сервисов.
Проектирует incident management процесс: автоматическая классификация инцидентов, интеграция PagerDuty с Slack/Jira/StatusPage. Внедряет incident commander роль, автоматизирует communication через chatops. Настраивает SLO-based alerting для снижения alert fatigue.
Проектирует масштабируемую logging-платформу: Elasticsearch-кластер для терабайтов логов, hot-warm-cold архитектура, cross-cluster search. Оптимизирует mapping и query performance, внедряет Elastic APM для distributed tracing. Настраивает anomaly detection.
Проектирует observability-платформу на OpenTelemetry: unified collection pipeline для traces/metrics/logs, tail-based sampling, context propagation. Внедряет OTel Operator для Kubernetes, настраивает adaptive sampling и correlation между сигналами.
Проектирует масштабируемую систему мониторинга: Thanos/Mimir для long-term storage и multi-cluster, recording rules для оптимизации. Создаёт SLO-дашборды с burn rate alerts, внедряет custom exporters. Настраивает federation и remote write.
Проектирует SLO-framework для организации: стандарты определения SLI для разных типов сервисов, автоматический расчёт error budget. Внедряет SLO-based alerting через Sloth/Pyrra, интегрирует с incident management и capacity planning.
Контроль версий и коллаборация · 3
Проектирует систему документации для DevOps: единый портал (Backstage) с автогенерированной документацией, runbooks с интеграцией мониторинга. Внедряет docs-as-code pipeline: автоматическая валидация, link checking, freshness alerts.
Проектирует процесс review инфраструктурного кода: automated checks (Checkov, tfsec, Conftest), обязательные reviewers по CODEOWNERS. Внедряет plan review для Terraform (Atlantis/Spacelift), определяет критерии approve для разных типов изменений.
Проектирует Git-стратегию для инфраструктурного кода: branching model для GitOps (trunk-based vs gitflow), структура monorepo/polyrepo. Настраивает advanced hooks (pre-commit для terraform fmt/validate), автоматизирует releases через semantic versioning.
Дополнительные навыки
Команда их не оценивает, но они входят в самооценку и план развития.
Что меняется на Lead
62 навыков получают более высокое ожидание или становятся ключевыми при переходе с Senior на Lead. Сначала самые большие скачки.
- Алгоритмы и сложность: Продвинутый → Эксперт
- Асинхронное программирование: Продвинутый → Эксперт
- Балансировка нагрузки: Продвинутый → Эксперт
- Бизнес-метрики: Продвинутый → Эксперт
- Документация как код: Продвинутый → Эксперт
- Качество кода и рефакторинг: Продвинутый → Эксперт
- Основы сетей: Продвинутый → Эксперт
- Основы System Design: Продвинутый → Эксперт
- Принципы ООП и SOLID: Продвинутый → Эксперт
- Сканирование безопасности контейнеров: Продвинутый → Эксперт
} в открытой матрице компетенций: 63 навыков на 5 уровнях. Матрица бесплатна для специалистов и останется бесплатной.