Оценивает алгоритмическую сложность облачных решений: стоимость обхода ресурсов через API, пагинация при работе с тысячами инстансов, оптимизация Lambda cold start. Определяет performance-бюджеты для IaC-пайплайнов и автоматизирует выявление деградации при масштабировании инфраструктуры.
Роли · Cloud Engineer · Lead
Что должен уметь Lead }
43 ключевых навыков, всего 58. Ожидания по каждому навыку и что меняется на следующем уровне.
На этой странице — что ожидается от Lead }, навык за навыком. Ключевые навыки оценивают руководитель и коллеги в цикле ревью; остальные учитываются только в самооценке. Основные области: Основы программирования, Backend Development, Облако и инфраструктура.
Ключевые навыки для Lead
Сгруппированы по областям. Метка справа — ожидаемая глубина: Осведомлённость, Применение, Продвинутый или Эксперт.
Основы программирования · 3
Формирует стандарты качества Infrastructure as Code: линтинг Terraform (tflint, checkov), валидация Helm-чартов, policy-as-code через OPA/Sentinel. Настраивает quality gates в CI/CD для инфраструктурных изменений и балансирует скорость деплоя с безопасностью.
Определяет стандарты хранения и структурирования конфигураций облачной инфраструктуры: иерархические state-файлы Terraform, DAG-и зависимостей ресурсов, графовые модели сетевых топологий. Ревьюит выбор структур данных для CloudFormation-стеков и Helm-чартов.
Backend Development · 1
Определяет архитектурные решения по S3 / Object Storage на уровне продукта. Формирует стандарты. Проводит design review и определяет технический roadmap.
Облако и инфраструктура · 18
Определяет стратегию балансировки нагрузки для облачной платформы: мультирегиональное управление трафиком, автоматизация failover и cost-optimized выбор балансировщиков. Устанавливает IaC-стандарты для провижинга балансировщиков и проводит архитектурные ревью.
Определяет сетевую стратегию организации: централизованный networking account, IP address management (IPAM), стандарты сегментации. Внедряет service mesh для микросервисов, zero-trust networking. Управляет сетевыми изменениями через IaC с автоматическим compliance.
Определяет инфраструктурную стратегию с Сканирование безопасности контейнеров. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.
Определяет стандарты автоматизации Ansible и лучшие практики для команд облачной инфраструктуры организации. Формирует рекомендации по разработке roles и collections, фреймворки тестирования с Molecule и governance Ansible Tower/AWX для самообслуживающегося провижининга облака. Проводит архитектурные ревью кодовых баз автоматизации и продвигает внедрение стандартизированных паттернов облачного провижининга через переиспользуемые Ansible collections.
Определяет AWS-стратегию организации: account vending machine, service control policies, централизованный networking (Transit Gateway Hub). Управляет enterprise support, cost allocation, budgets и alerts. Внедряет FinOps-практики и оптимизирует расходы на уровне компании.
Определяет стратегию CDN и edge computing в мультиоблачных средах. Устанавливает стандарты кэширования, политики безопасности на edge и FinOps-оптимизацию доставки контента. Проводит архитектурные ревью для глобальной дистрибуции контента.
Определяет стандарты контейнеризации для организации: golden base images, security hardening guidelines, policy сканирования образов. Внедряет автоматизацию обновления базовых образов и патч-менеджмент для container runtime.
Определяет инфраструктурную стратегию с Google Cloud Platform. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.
Определяет стандарты Helm-чартов и library-чарты для организационных Kubernetes-деплойментов. Устанавливает процессы ревью чартов, сканирование безопасности и управление версионированием. Продвигает внедрение GitOps-воркфлоу с Helm и ArgoCD или Flux.
Определяет стратегию мульти-кластерного Kubernetes между облачными провайдерами. Выстраивает GitOps-процессы с ArgoCD/Flux, внедряет политики service mesh и оптимизирует затраты на кластеры с практиками FinOps.
Определяет стандарты Kubernetes для организации: cluster provisioning через IaC, security baseline (CIS benchmarks), мониторинг здоровья кластеров. Внедряет platform engineering подход — internal developer platform на базе Kubernetes.
Определяет инфраструктурную стратегию с Microsoft Azure. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.
Определяет стратегию облачной инфраструктуры с Pulumi: устанавливает стандарты IaC, governance реестра модулей и workflow продвижения между окружениями. Проводит архитектурные ревью для кросс-командного внедрения Pulumi. Оптимизирует FinOps через автоматизированные политики расходов и управление жизненным циклом.
Определяет инфраструктурную стратегию с Serverless Containers. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.
Определяет serverless-first стратегию инфраструктуры в масштабе организации. Устанавливает стандарты IaC для деплоя функций, мониторинга и управления затратами. Проводит архитектурные ревью serverless-решений и оптимизирует FinOps для compute-расходов.
Определяет стандарты IaC для организации: структура репозиториев, naming conventions, tagging strategy, module registry. Внедряет policy-as-code через Sentinel/OPA, drift detection, cost estimation (Infracost). Обучает команды best practices Terraform.
Определяет стратегию VPN и сетевой изоляции для облачной инфраструктуры: устанавливает стандарты подключения, паттерны transit-архитектуры и политики zero-trust сети. Проводит архитектурные ревью мультиоблачных сетевых дизайнов. Оптимизирует сетевые расходы через traffic engineering и планирование interconnects.
Определяет инфраструктурную стратегию с Yandex Cloud. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.
DevOps и CI/CD · 4
Определяет стратегию ArgoCD и стандарты GitOps для флота облачной инфраструктуры организации. Формирует мультитенантный governance ArgoCD со структурами проектов, политиками RBAC и процессами согласования. Проводит архитектурные ревью конфигураций ArgoCD и продвигает внедрение декларативных паттернов доставки инфраструктуры в облачных командах.
Определяет DevOps-стратегию с Blue/Green Deployment. Формирует стандарты CI/CD. Внедряет platform engineering подходы.
Определяет DevOps-стратегию с Canary Deployment. Формирует стандарты CI/CD. Внедряет platform engineering подходы.
Определяет стратегию CI/CD для всех инфраструктурных репозиториев: стандартные workflow templates, self-hosted runners в приватных сетях, secrets management через OIDC. Внедряет governance — required reviews, environment protection rules, audit trail для infrastructure changes.
Безопасность · 2
Определяет security-стратегию облачной платформы: security baseline для новых аккаунтов, incident response runbooks, vulnerability management program. Внедряет CSPM (Cloud Security Posture Management), обучает команды secure-by-default подходу. Управляет security exceptions и risk acceptance.
Определяет стратегию управления секретами для организации: Vault vs AWS Secrets Manager vs GCP Secret Manager, namespace hierarchy для мульти-тенантности, emergency break-glass процедуры. Внедряет compliance-контроли и автоматический аудит доступа к секретам.
AI-ассистированная разработка · 1
Определяет политику использования AI-инструментов для инфраструктурной разработки: approved tools, security review AI-сгенерированного IaC, интеграция в CI/CD для автоматического review. Оценивает ROI и внедряет best practices по сочетанию AI-генерации с human review.
Архитектура и проектирование · 4
Определяет архитектурные стандарты организации: technology radar, reference architectures для типовых сценариев (REST API, event processing, data pipeline). Формирует архитектурный review process и обучает команды cloud-native design patterns.
Определяет архитектурную стратегию продукта с Capacity Planning. Формирует architecture guidelines. Проводит architecture review.
Определяет архитектурную стратегию продукта с Disaster Recovery Design. Формирует architecture guidelines. Проводит architecture review.
Определяет архитектурные стандарты для высоконагруженных cloud-native систем: reference architectures, performance budgets, scalability review checklist. Проводит architecture review, выявляет bottleneck-и через load testing и проектирует capacity planning процессы.
Observability и мониторинг · 6
Определяет организационные стандарты логирования: mandatory fields, log levels policy, sensitive data handling. Внедряет automated log validation в CI/CD, мониторинг соблюдения стандартов. Обучает команды best practices и проводит review logging-конфигураций.
Определяет on-call стратегию для облачной организации: follow-the-sun ротация, tier-1/tier-2 эскалация, incident commander role. Внедряет incident management process (ITIL/SRE), blameless postmortems, reliability metrics (MTTA, MTTR). Управляет балансом on-call нагрузки и burnout prevention.
Определяет logging-стратегию организации: централизованный logging account, compliance requirements (audit trails, retention), cost optimization. Внедряет стандарты логирования для всех облачных workloads, настраивает alerting на аномалии и security events.
Определяет observability-стратегию на основе OpenTelemetry: unified collection pipeline, vendor-agnostic instrumentation, стандарты для всех команд. Управляет стоимостью telemetry data через sampling strategies и tiered storage. Внедряет SLO-based alerting на основе traces.
Определяет стратегию метрик для облачной платформы: Prometheus vs CloudWatch vs Datadog, golden signals framework, стандартные dashboards для каждого типа workload. Внедряет SLO-based monitoring, budget alerts и automated capacity recommendations на основе метрик.
Определяет SLO-культуру организации: SLO review process, error budget governance, SLA negotiations с клиентами. Внедряет tooling (Sloth, Google SLO Generator) и стандарты для всех cloud-сервисов. Балансирует reliability requirements и скорость delivery на основе error budgets.
Контроль версий и коллаборация · 3
Определяет стандарты документирования инфраструктуры: template для ADR, runbook structure, service catalog format. Внедряет docs-as-code workflow — PR-based updates, automated freshness checks, documentation coverage metrics. Обучает команды культуре документирования.
Определяет процесс review для инфраструктурных изменений: review checklist, mandatory approvals по severity (production = 2+ approvals), automated policy checks. Формирует культуру качественного review — knowledge sharing, не gate-keeping. Балансирует скорость и безопасность.
Определяет стратегию управления IaC-репозиториями: repo topology, access control, branch protection rules, mandatory reviews для production changes. Внедряет GitOps workflow — инфраструктурные изменения только через PR с автоматическим plan и manual approve для apply.
Документация · 1
Определяет runbook strategy для организации: coverage requirements (каждый сервис — минимум 5 runbooks), review process, freshness policy. Внедряет self-healing runbooks — автоматическое исполнение при определённых алертах. Связывает runbooks с SLOs и incident severity levels.
Дополнительные навыки
Команда их не оценивает, но они входят в самооценку и план развития.
Что меняется на Principal
0 навыков получают более высокое ожидание или становятся ключевыми при переходе с Lead на Principal. Сначала самые большие скачки.
} в открытой матрице компетенций: 58 навыков на 5 уровнях. Матрица бесплатна для специалистов и останется бесплатной.