Проектирует высоконагруженные пайплайны обработки данных с учётом алгоритмической сложности. Оптимизирует скрипты автоматизации инфраструктуры по O(n), применяет эффективные структуры для парсинга логов и маршрутизации событий. Проводит ревью скриптов команды на предмет производительности и масштабируемости.
Роли · DevOps Engineer · Lead
Что должен уметь Lead }
46 ключевых навыков, всего 63. Ожидания по каждому навыку и что меняется на следующем уровне.
На этой странице — что ожидается от Lead }, навык за навыком. Ключевые навыки оценивают руководитель и коллеги в цикле ревью; остальные учитываются только в самооценке. Основные области: Основы программирования, Backend Development, Базы данных.
Ключевые навыки для Lead
Сгруппированы по областям. Метка справа — ожидаемая глубина: Осведомлённость, Применение, Продвинутый или Эксперт.
Основы программирования · 5
Проектирует асинхронные системы оркестрации: параллельное выполнение этапов CI/CD, конкурентный деплой в несколько окружений, неблокирующий сбор метрик. Применяет event-driven подход для реакции на инфраструктурные события в реальном времени.
Внедряет культуру качества кода в DevOps-команде: обязательные линтеры для Terraform/Ansible, статический анализ Dockerfile, проверки Helm-чартов. Настраивает quality gates в CI/CD-пайплайнах, проводит систематическое ревью инфраструктурного кода.
Проектирует модульные библиотеки автоматизации с применением SOLID-принципов. Создаёт расширяемые плагины для CI/CD-систем, использует паттерны Strategy и Factory для конфигурирования инфраструктурных компонентов. Обеспечивает переиспользуемость кода между командами.
Применяет продвинутые структуры данных для оптимизации DevOps-инструментария: деревья для конфигураций, графы зависимостей сервисов, хеш-таблицы для кэширования артефактов. Проектирует эффективные схемы хранения метаданных пайплайнов и состояний инфраструктуры.
Backend Development · 3
Проектирует архитектуру событийной платформы на Kafka для DevOps: агрегация логов, потоковая обработка алертов, event sourcing инфраструктурных изменений. Оптимизирует производительность кластеров, настраивает geo-репликацию и disaster recovery.
Проектирует архитектуру внутренних DevOps-платформ на Python: self-service порталы для разработчиков, системы управления окружениями, API-gateway для инфраструктурных операций. Определяет стандарты разработки и обеспечивает масштабируемость решений.
Проектирует стратегию кэширования для DevOps-платформы: Redis-кластеры для хранения состояний пайплайнов, распределённые блокировки для деплоев, очереди задач автоматизации. Оптимизирует производительность и настраивает автоматический failover.
Базы данных · 1
Определяет стратегию управления PostgreSQL на уровне платформы: стандарты деплоя через Helm-чарты, политики бэкапирования и восстановления, автоматическое масштабирование. Проектирует Database-as-a-Service для внутренних команд с self-service провизионированием.
API и интеграции · 1
Определяет стандарты API-first подхода для DevOps-платформы: единый API-gateway для инфраструктурных операций, контракты между микросервисами, автогенерация SDK. Проектирует архитектуру интеграций между CI/CD, мониторингом и инфраструктурой.
Облако и инфраструктура · 12
Определяет стратегию балансировки нагрузки организации: стандарты для всех типов сервисов, автоматизация конфигурации, интеграция с service mesh. Проектирует глобальную архитектуру трафика с учётом disaster recovery и multi-region failover.
Определяет сетевую стратегию организации: hub-and-spoke или mesh-топологии, стандарты сегментации и zero-trust networking. Проектирует архитектуру для multi-cloud connectivity, DNS governance, автоматизацию сетевых операций через NetOps.
Определяет стратегию container security для организации: стандарты допуска образов, автоматизированный vulnerability management, метрики MTTR для уязвимостей. Проектирует централизованную платформу сканирования с интеграцией в SIEM и incident management.
Определяет стандарты автоматизации Ansible и паттерны DevOps-процессов для инженерной организации. Формирует рекомендации по разработке playbooks, практики тестирования с Molecule и ansible-lint, и governance Tower/AWX для самообслуживающейся автоматизации команд. Проводит архитектурные ревью кодовых баз автоматизации и менторит команды по идемпотентному дизайну, управлению секретами и масштабируемой разработке roles.
Определяет облачную стратегию на AWS для организации: Landing Zone архитектура, multi-account strategy с Control Tower, FinOps-практики. Проектирует сетевую архитектуру для сотен сервисов, стандарты безопасности через GuardDuty, SecurityHub и Config Rules.
Определяет стратегию edge-инфраструктуры организации: выбор CDN-провайдеров, стандарты конфигурации, FinOps для CDN. Проектирует архитектуру edge computing для снижения латентности, интеграцию с мониторингом и alerting для глобальной доступности.
Определяет корпоративные стандарты контейнеризации: golden images, политики безопасности образов, автоматизированный lifecycle management. Проектирует внутренний Container Registry с автоочисткой, vulnerability scanning и admission policies для Kubernetes.
Определяет стратегию Helm для организации: стандартные library-чарты, процессы версионирования и публикации, автоматическое обновление зависимостей. Проектирует внутренний Helm-реестр с CI/CD для чартов, шаблоны для самых распространённых паттернов деплоя.
Определяет архитектуру Kubernetes-платформы организации: стандарты кластеров, multi-cluster management (Rancher/Tanzu), федерация. Проектирует platform engineering слой: абстракции над Kubernetes для разработчиков, стандарты безопасности CIS benchmark.
Определяет стандарты деплоя в Kubernetes: golden path для разработчиков, шаблоны манифестов, обязательные проверки (OPA/Kyverno). Проектирует процессы продвижения релизов между окружениями, автоматизирует канареечные и blue-green деплои.
Определяет стандарты IaC на Terraform для организации: модульный реестр, code review процессы, blast radius management. Проектирует архитектуру Terraform Cloud/Enterprise для multi-team работы, стандарты именования, tagging и cost allocation.
Определяет стратегию удалённого доступа: переход от традиционного VPN к zero-trust (BeyondCorp), стандарты подключения для всех команд. Проектирует архитектуру secure access для мульти-облачной среды с централизованным управлением и аудитом.
DevOps и CI/CD · 8
Определяет стратегию платформы ArgoCD и стандарты доставки GitOps для инженерной организации. Формирует фреймворки governance для мультитенантных деплоев ArgoCD, включая структуры проектов, иерархии RBAC и процессы управления изменениями. Проводит архитектурные ревью и менторит команды по лучшим практикам GitOps и операционному совершенству ArgoCD.
Определяет стандарты blue-green деплоя для организации: когда применять blue-green vs canary vs rolling, чек-листы валидации. Проектирует универсальный deployment pipeline с выбором стратегии, автоматической верификацией и SLO-based promotion.
Определяет стратегию progressive delivery для организации: стандарты canary analysis, обязательные метрики и SLO-пороги для promotion. Проектирует unified delivery pipeline с автоматизированным canary для всех типов сервисов, интеграцию с incident management.
Определяет организационные стандарты feature management: governance для флагов, обязательные метаданные, процессы ревью. Проектирует платформу progressive delivery с интеграцией feature flags, monitoring и automated rollback на основе SLO.
Определяет стандарты CI/CD на GitHub Actions для организации: reusable workflow библиотека, стандарты безопасности runners, governance и compliance. Проектирует архитектуру self-hosted runners с автоскейлингом, метрики эффективности пайплайнов.
Определяет стандарты GitLab CI/CD для организации: библиотека include-шаблонов, compliance framework, стандарты runner-инфраструктуры. Проектирует multi-project pipeline архитектуру, метрики DORA для оценки эффективности delivery.
Стандартизирует GitOps для организации: определяет repository strategy и branching model для GitOps repos, создаёт templates для standardized deployments, внедряет GitOps compliance (audit trail, change approval). Обучает команды GitOps practices.
Определяет DevOps-стратегию с Jenkins. Формирует стандарты CI/CD. Внедряет platform engineering подходы.
Тестирование и QA · 1
Внедряет культуру chaos engineering: обучает команды проектированию экспериментов, создает safety net для production chaos (abort conditions, blast radius control). Проектирует chaos матрицу для покрытия всех типов failures: infrastructure, network, application, database.
Безопасность · 2
Определяет стратегию DevSecOps для организации: стандарты безопасности CI/CD, политики допуска образов в production, автоматический compliance. Внедряет security-as-code подход, проектирует систему централизованного управления уязвимостями и инцидентами безопасности.
Определяет стратегию управления секретами на уровне организации: стандарты интеграции Vault со всеми системами, политики ротации и доступа, автоматизированный onboarding новых сервисов. Проектирует мульти-кластерную архитектуру Vault с DR.
AI-ассистированная разработка · 1
Определяет политики использования AI-ассистентов для инфраструктурного кода: security guidelines, разрешённые сценарии, процессы review. Оценивает влияние Copilot на продуктивность DevOps-команды, внедряет Copilot for Business с организационными настройками.
Архитектура и проектирование · 2
Определяет архитектурные стандарты инфраструктуры организации: reference architectures для типичных паттернов (web app, API, data pipeline). Проводит architecture reviews, определяет guidelines масштабирования и отказоустойчивости для всех команд.
Определяет DR-стратегию организации: классификация сервисов по критичности, стандарты RPO/RTO для каждого tier. Проектирует платформу автоматизированного DR-тестирования, процессы game days и tabletop exercises. Управляет DR-бюджетом и приоритизацией.
Observability и мониторинг · 7
Определяет организационные стандарты метрик: обязательные SLI для каждого tier сервиса, DORA metrics dashboard, FinOps-метрики. Проектирует metrics platform с каталогом стандартных метрик, self-service инструментированием и автоматическим alerting.
Определяет организационные стандарты observability через логи: mandatory fields, log levels policy, PII-фильтрация. Проектирует платформу log analytics с ML-powered anomaly detection, автоматическим корреляционным анализом инцидентов.
Определяет стратегию incident management для организации: стандарты severity levels, escalation matrices, communication protocols. Проектирует процесс blameless post-mortems, метрики MTTR/MTTA, программу SRE on-call с sustainable rotation.
Определяет стратегию централизованного логирования: стандарты structured logging для всех команд, SLA платформы, cost optimization. Проектирует multi-tenant logging платформу, data retention policies, интеграцию с alerting и incident management.
Определяет стратегию observability на OpenTelemetry для организации: стандарты инструментирования, semantic conventions, vendor-agnostic pipeline. Проектирует centralized OTel infrastructure с multi-tenant Collector fleet, governance и cost management.
Определяет стратегию мониторинга организации: стандарты метрик (RED, USE), обязательные дашборды для каждого сервиса, SLO framework. Проектирует централизованную Prometheus-платформу с multi-tenancy, cost-effective retention и self-service для команд.
Определяет SRE-культуру через SLO: стандарты для каждого tier сервиса, error budget policies (feature freeze при исчерпании). Проектирует организационный SLO dashboard, процессы review и пересмотра целей, интеграцию с product management.
Контроль версий и коллаборация · 3
Определяет стандарты документирования для организации: обязательная документация для каждого сервиса, шаблоны ADR и runbooks, процессы review. Проектирует Internal Developer Portal с каталогом сервисов, автоматической документацией и search.
Определяет культуру code review в DevOps-организации: стандарты quality gates, автоматизированные compliance checks, review SLA. Проектирует workflow от PR до production: automated testing, security scanning, plan review, approval chain.
Определяет стандарты управления кодом: branching strategy для всех команд, commit conventions, merge policies. Проектирует repository structure для GitOps (app repo vs config repo), процессы code ownership и CODEOWNERS, стандарты для 100+ репозиториев.
Дополнительные навыки
Команда их не оценивает, но они входят в самооценку и план развития.
Что меняется на Principal
0 навыков получают более высокое ожидание или становятся ключевыми при переходе с Lead на Principal. Сначала самые большие скачки.
} в открытой матрице компетенций: 63 навыков на 5 уровнях. Матрица бесплатна для специалистов и останется бесплатной.