Проектирует стратегии обработки данных в масштабе облачной платформы: оптимальные алгоритмы авто-скейлинга, балансировка нагрузки с учётом latency и стоимости, эффективные стратегии шардирования DNS и маршрутизации трафика между регионами.
Роли · Cloud Engineer · Principal
Что должен уметь Principal }
43 ключевых навыков, всего 58. Ожидания по каждому навыку и что меняется на следующем уровне.
На этой странице — что ожидается от Principal }, навык за навыком. Ключевые навыки оценивают руководитель и коллеги в цикле ревью; остальные учитываются только в самооценке. Основные области: Основы программирования, Backend Development, Облако и инфраструктура.
Ключевые навыки для Principal
Сгруппированы по областям. Метка справа — ожидаемая глубина: Осведомлённость, Применение, Продвинутый или Эксперт.
Основы программирования · 3
Определяет стратегию качества IaC на уровне организации: единые стандарты модулей Terraform, golden templates для облачных сервисов, автоматизированный compliance. Управляет техническим долгом инфраструктуры и планирует миграцию legacy-конфигураций.
Проектирует модели данных для управления облачной платформой: CMDB, service catalog, cost allocation trees. Принимает стратегические решения о хранении state — S3 backend vs Terraform Cloud, структурировании мультиаккаунтных иерархий AWS Organizations.
Backend Development · 1
Определяет стратегию S3 / Object Storage на уровне компании. Оценивает новые технологии и подходы. Формирует enterprise-стандарты и reference architectures.
Облако и инфраструктура · 18
Определяет стратегию балансировки нагрузки на уровне платформы: L4 (NLB) vs L7 (ALB) vs Global (GCLB), multi-region load balancing с GeoDNS, service mesh для internal traffic. Проектирует zero-downtime deployment patterns и архитектуру traffic management для canary/blue-green releases.
Формирует сетевую архитектуру на уровне платформы: global backbone, multi-region connectivity, cloud interconnect strategy. Проектирует решения для edge computing, CDN интеграции, hybrid DNS. Определяет стандарты сетевой безопасности и Zero Trust Architecture.
Определяет стратегию безопасности контейнеров на уровне платформы: интеграция Trivy/Snyk в CI/CD, admission controllers в Kubernetes для блокировки уязвимых образов, runtime protection через Falco/Aqua. Формирует SLA по устранению CVE и автоматизирует compliance reporting.
Формирует стратегию автоматизации инфраструктуры организации с Ansible как ключевым инструментом мультиоблачного управления конфигурацией. Двигает инновации в облачной автоматизации на Ansible — event-driven автоматизация с ansible-rulebook, паттерны интеграции GitOps и self-healing playbooks инфраструктуры. Влияет на практики сообщества Ansible через вклад в cloud provider collections и доклады на конференциях по автоматизации облака корпоративного масштаба.
Формирует облачную стратегию на уровне предприятия: multi-region disaster recovery, hybrid cloud (Outposts, Direct Connect), compliance frameworks (SOC2, HIPAA, PCI DSS). Проектирует reference architectures и принимает стратегические решения о cloud-native vs lift-and-shift.
Определяет стратегию CDN и edge computing: CloudFront/Cloud CDN для статики и API acceleration, Lambda@Edge/CloudFlare Workers для edge logic. Проектирует архитектуру кэширования — cache invalidation, origin shield, multi-CDN failover для глобальных приложений.
Формирует стратегию контейнерной платформы: выбор между ECS/EKS/Fargate/Cloud Run, стандарты для multi-tenant окружений, governance для container registries. Проектирует архитектуру supply chain security для контейнерных артефактов.
Определяет стратегию использования GCP в мультиоблачной архитектуре: BigQuery для аналитики, GKE Autopilot для Kubernetes, Anthos для hybrid cloud. Проектирует интеграцию GCP с AWS/Azure, оценивает преимущества GCP для ML/AI workloads и data-intensive приложений.
Проектирует архитектуру Helm-экосистемы организации: umbrella charts для сложных приложений, library charts для переиспользования, Helmfile для управления releases. Определяет стандарты версионирования, template-функций и values-иерархий для мультикластерных окружений.
Формирует стратегию развития Kubernetes-платформы: multi-cluster federation, service mesh (Istio/Linkerd), GitOps через ArgoCD/Flux. Проектирует кастомные операторы, admission webhooks, scheduler extensions. Определяет архитектуру multi-tenancy и resource governance.
Формирует стратегию контейнерной оркестрации на уровне компании: multi-cluster топология, cross-region failover, hybrid cloud deployment. Оценивает альтернативы (Nomad, ECS) и принимает стратегические решения о развитии Kubernetes-платформы.
Формирует стратегию Azure для enterprise: Azure Landing Zones, Azure Arc для hybrid, Azure DevOps для CI/CD. Проектирует интеграцию с Active Directory/Entra ID, определяет use cases Azure vs AWS — compliance, Microsoft ecosystem, government cloud.
Оценивает Pulumi как стратегическую альтернативу Terraform: преимущества real programming languages для сложной логики, Automation API для self-service платформ, Policy as Code через CrossGuard. Определяет use cases для Pulumi vs Terraform в мультиоблачной архитектуре.
Определяет стратегию serverless containers для организации: AWS Fargate vs Google Cloud Run vs Azure Container Apps. Проектирует архитектуру для burst workloads, event-driven scaling, оптимизацию cold start. Формирует cost model и guidelines по выбору между serverless и dedicated compute.
Формирует стратегию serverless-архитектуры: Lambda/Cloud Functions для event processing, API Gateway integration, Step Functions для оркестрации. Проектирует patterns — fan-out/fan-in, saga, circuit breaker. Определяет границы применимости serverless и миграционные пути.
Формирует стратегию Infrastructure as Code на уровне компании: multi-cloud provisioning, Terraform Enterprise/Cloud vs self-hosted, модульная платформа для self-service. Проектирует архитектуру state management для сотен стеков и десятков команд.
Формирует VPN-стратегию организации: Site-to-Site VPN vs Direct Connect/ExpressRoute, client VPN для удалённого доступа, mesh VPN между облаками. Проектирует high-availability VPN с BGP, failover и мониторингом. Определяет миграционный путь к Zero Trust Network Access (ZTNA).
Определяет стратегию Yandex Cloud для российского рынка: Managed Kubernetes, Object Storage, Cloud Functions. Оценивает compliance с ФЗ-152, интеграцию с локальной инфраструктурой, миграционные пути между Yandex Cloud и международными провайдерами.
DevOps и CI/CD · 4
Формирует стратегию GitOps организации на основе ArgoCD для доставки облачных платформ корпоративного масштаба. Принимает архитектурные решения по мультикластерной федерации ArgoCD, паттернам disaster recovery и интеграции с cloud-native control planes. Влияет на индустриальные практики через вклад в экосистему ArgoCD и стандарты сообщества GitOps.
Формирует стратегию blue-green deployments для облачной инфраструктуры: Route 53 weighted routing, ALB target group switching, ECS blue-green через CodeDeploy. Проектирует автоматизацию rollback, database migration strategy и smoke testing для zero-downtime инфраструктурных обновлений.
Определяет стратегию canary deployments на уровне платформы: progressive delivery через Flagger/Argo Rollouts, weighted traffic shifting через service mesh, автоматический rollback на основе SLO metrics. Проектирует observability pipeline для canary analysis и интеграцию с cloud-native load balancers.
Формирует платформу автоматизации инфраструктурных изменений: GitOps с GitHub Actions как orchestrator, интеграция с Terraform Cloud/Spacelift, multi-cloud deployment pipelines. Проектирует self-service developer platform с guardrails для безопасного провижонинга ресурсов.
Безопасность · 2
Формирует стратегию облачной безопасности на уровне предприятия: Zero Trust Architecture, cloud-native SIEM (CloudTrail Lake, Chronicle), supply chain security. Определяет compliance frameworks (SOC2, ISO 27001, PCI DSS), проектирует security reference architecture для multi-cloud.
Формирует платформу управления секретами на enterprise-уровне: multi-region Vault с disaster recovery, cross-cloud secrets synchronization, zero-trust secret distribution. Определяет cryptographic standards, key management strategy и интеграцию с HSM для критических workloads.
AI-ассистированная разработка · 1
Формирует стратегию AI-assisted Infrastructure Engineering: custom AI-модели для генерации IaC по организационным стандартам, AI-driven anomaly detection в инфраструктуре, predictive scaling. Определяет boundaries применимости AI и governance framework для AI-driven infrastructure changes.
Архитектура и проектирование · 4
Формирует архитектурную стратегию облачной платформы: domain-driven cloud architecture, platform engineering vision, build vs buy framework. Проектирует cross-cutting concerns — observability, security, networking — как platform capabilities и определяет technology governance.
Определяет стратегию capacity planning для облачной платформы: predictive scaling на основе ML-моделей, reserved capacity management, burst-to-cloud сценарии. Проектирует FinOps-процессы — unit economics, capacity forecasting, rightsizing recommendations. Балансирует cost и availability на enterprise-уровне.
Формирует DR-стратегию на уровне организации: multi-region active-active vs pilot light vs warm standby, RPO/RTO матрица по criticality. Проектирует автоматизированный failover через Route 53 health checks и cross-region replication. Организует регулярные DR-учения и gameday exercises.
Формирует стратегию масштабируемости облачной платформы: cell-based architecture, multi-region active-active с conflict resolution, edge computing для latency-sensitive workloads. Проектирует platform abstractions для автоматического scaling и cost-effective обработки пиковых нагрузок.
Observability и мониторинг · 6
Формирует logging governance на уровне платформы: schema registry для log formats, automated compliance validation, cross-service correlation framework. Проектирует интеграцию structured logs с tracing и metrics для unified observability stack.
Формирует incident management framework на enterprise-уровне: unified incident process для multi-cloud, automated incident response (AWS Systems Manager, PagerDuty Rundeck), AIOps для anomaly detection. Определяет organizational resilience стратегию и chaos engineering program.
Формирует стратегию log management на enterprise-уровне: выбор платформы (OpenSearch vs Datadog vs Splunk), unified logging для multi-cloud, log-based security analytics. Проектирует data pipeline для обработки петабайт логов с cost-effective хранением и compliance.
Формирует enterprise observability platform на основе OpenTelemetry: multi-cloud telemetry aggregation, custom semantic conventions для cloud resources, auto-instrumentation platform. Проектирует AI-driven analysis на основе telemetry data и определяет observability maturity framework.
Формирует observability platform на enterprise-уровне: unified metrics across clouds (Grafana Cloud/Datadog), custom metric taxonomies, FinOps dashboards. Проектирует архитектуру для обработки миллионов time series с cost-effective storage и sub-second query latency.
Формирует reliability engineering стратегию: platform-wide SLO framework, business-aligned reliability targets, cost of reliability analysis. Проектирует SLO platform для автоматического tracking сотен сервисов, определяет reliability investment priorities на уровне организации.
Контроль версий и коллаборация · 3
Формирует documentation strategy на enterprise-уровне: unified service catalog, automated architecture documentation from IaC, knowledge base для operational procedures. Проектирует internal developer platform с self-service docs, API reference и interactive architecture explorer.
Формирует review governance на уровне платформы: automated compliance validation, risk-based review tiers, architecture review board для крупных изменений. Проектирует tooling для automated IaC review — policy engines, cost estimation, security scanning интегрированные в review workflow.
Формирует Git-стратегию для инфраструктурной платформы: mono-repo governance для сотен модулей, automated dependency management, release management для shared IaC libraries. Проектирует developer experience для self-service infrastructure provisioning через Git-based workflows.
Документация · 1
Формирует operational knowledge management на enterprise-уровне: AI-assisted runbook generation, automated validation через chaos engineering, runbook-as-code в Git. Проектирует платформу для управления операционными знаниями с версионированием, testing и continuous improvement.
Дополнительные навыки
Команда их не оценивает, но они входят в самооценку и план развития.
} в открытой матрице компетенций: 58 навыков на 5 уровнях. Матрица бесплатна для специалистов и останется бесплатной.