Роли · Infrastructure Engineer · Lead

Что должен уметь Lead }

45 ключевых навыков, всего 60. Ожидания по каждому навыку и что меняется на следующем уровне.

На этой странице — что ожидается от Lead }, навык за навыком. Ключевые навыки оценивают руководитель и коллеги в цикле ревью; остальные учитываются только в самооценке. Основные области: Основы программирования, Backend Development, Базы данных.

45ключевых навыков
15дополнительных навыков
12областей
100%на уровне Продвинутый или Эксперт
Оценить себя как Lead Полная матрица роли

Ключевые навыки для Lead

Сгруппированы по областям. Метка справа — ожидаемая глубина: Осведомлённость, Применение, Продвинутый или Эксперт.

Основы программирования · 4

Проводит ревью алгоритмических решений в инфраструктурных инструментах: анализ сложности скриптов провизионирования, оптимизация обхода графов зависимостей между сервисами. Оценивает алгоритмы планирования деплоя и размещения контейнеров, внедряет стандарты производительности автоматизации для флота из сотен серверов.

Внедряет паттерны асинхронного выполнения в инфраструктурной автоматизации: параллельный деплой на группы серверов, конкурентные health-check-и, неблокирующий сбор метрик. Стандартизирует обработку таймаутов и retry-стратегии для операций с облачными API, которые могут длиться минуты.

Внедряет практики качества инфраструктурного кода: tflint и checkov для Terraform, ansible-lint для плейбуков, shellcheck для bash-скриптов. Настраивает CI-пайплайны с автоматической валидацией IaC, определяет стандарты code review для модулей инфраструктуры и политики мёржа.

Стандартизирует подходы к моделированию инфраструктурных данных: inventory-файлы хостов, YAML-конфиги сервисов, деревья DNS-записей. Ревьюит выбор структур данных в IaC-модулях — маппинги ресурсов Terraform, вложенные переменные Ansible, иерархии конфигураций Helm-чартов.

Backend Development · 3

Apache Kafka Эксперт

Проектирует инфраструктуру Kafka как платформенный сервис для команд разработки: стандарты развёртывания кластеров, политики ретеншена, схемы авторизации через ACL. Внедряет GitOps-подход к управлению Kafka-топиками и определяет SLO для пропускной способности и латентности брокеров.

Python Web Frameworks Эксперт

Проектирует архитектуру внутренних платформенных сервисов на Python: self-service API для управления инфраструктурой, webhook-серверы для GitOps-пайплайнов, административные панели. Определяет стандарты разработки инфраструктурных бэкендов, ревьюит интеграции с Terraform Cloud API и Vault.

Redis Эксперт

Проектирует Redis как управляемый платформенный сервис: стандарты развёртывания кластеров, политики бэкапов, шардинг-стратегии. Определяет SLO для Redis-инфраструктуры, внедряет self-service провизионирование инстансов и обеспечивает мониторинг через Prometheus-экспортёры.

Базы данных · 3

Определяет стратегию работы с данными на уровне продукта. Формирует стандарты Репликация и High Availability. Проводит review схем данных и стратегий масштабирования.

Определяет стратегию работы с данными на уровне продукта. Формирует стандарты Backup и Disaster Recovery. Проводит review схем данных и стратегий масштабирования.

PostgreSQL Эксперт

Проектирует PostgreSQL как платформенный сервис для разработчиков: self-service создание инстансов через Terraform, стандарты конфигурации для разных workload-профилей, автоматизация обновлений. Определяет SLO для доступности и производительности БД, ревьюит архитектурные решения команды.

API и интеграции · 1

REST API Design Эксперт

Определяет стандарты API для внутренних платформенных сервисов: единый формат ошибок, конвенции именования, версионирование, аутентификация через service accounts. Ревьюит API-интерфейсы инфраструктурных инструментов команды и обеспечивает совместимость с корпоративным API-gateway.

Облако и инфраструктура · 17

Определяет стратегию инфраструктуры балансировки нагрузки: выбор технологий (hardware vs software), стандарты HA-конфигурации и планирование ёмкости для роста трафика. Устанавливает процедуры мониторинга, алертинга и реагирования на инциденты отказа балансировщиков.

Основы сетей Эксперт

Определяет сетевые стандарты инфраструктуры организации: IP-адресация и CIDR-планирование для сотен VPC, стандарты firewall-правил, политики DNS-именования. Ревьюит сетевую архитектуру команд, проектирует observability для сетевого трафика и определяет SLO для сетевой доступности.

Определяет стандарты container security для организации: политики допуска образов в продакшен, SLA на исправление уязвимостей по severity, процессы обработки zero-day CVE. Внедряет shift-left security через сканирование на этапе разработки и ревьюит security-архитектуру контейнерных workload-ов.

Ansible Эксперт

Определяет стандарты автоматизации Ansible для команд инфраструктурной инженерии организации. Формирует практики infrastructure-as-code с Ansible — рекомендации по разработке roles, фреймворки тестирования с Molecule и governance Tower/AWX для управления изменениями и самообслуживающегося провижининга. Проводит архитектурные ревью автоматизации инфраструктуры и продвигает стандартизацию паттернов провижининга серверов, управления конфигурацией и автоматизации жизненного цикла.

AWS Эксперт

Определяет стандарты AWS-инфраструктуры для организации: landing zone архитектура, account vending через Control Tower, стандарты тегирования для FinOps. Ревьюит AWS-архитектуру команд по Well-Architected Framework, внедряет self-service через Service Catalog и определяет SLO для AWS-сервисов.

CDN и Edge Computing Эксперт

Архитектурирует глобальную CDN-топологию с edge computing для критичных к задержкам нагрузок. Устанавливает IaC-стандарты для провижининга CDN и управления кэшем между командами. Внедряет FinOps-практики для оптимизации расходов на CDN и трафик.

Crossplane Эксперт

Определяет инфраструктурную стратегию с Crossplane. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.

Docker Эксперт

Определяет стандарты контейнеризации для организации: политики базовых образов с автоматическим обновлением, pipeline-ы сканирования, стратегии тегирования. Ревьюит Dockerfile-ы команд на соответствие best practices, управляет инфраструктурой registry с geo-репликацией и retention-политиками.

Envoy Proxy Эксперт

Определяет инфраструктурную стратегию с Envoy Proxy. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.

Helm Эксперт

Архитектурирует стратегию деплойментов на основе Helm в мультикластерных Kubernetes-средах. Устанавливает IaC-стандарты для разработки чартов, тестирования и воркфлоу продвижения. Оптимизирует управление Helm-релизами для масштабной инфраструктуры с FinOps-практиками.

Istio Service Mesh Эксперт

Определяет инфраструктурную стратегию с Istio Service Mesh. Формирует стандарты IaC. Проводит architecture review. Оптимизирует FinOps.

Kubernetes Advanced Эксперт

Определяет стратегию платформы Kubernetes, включая автоматизацию provisioning кластеров, стандарты усиления безопасности и процедуры аварийного восстановления. Проводит архитектурные ревью по размещению нагрузок и оптимизации ресурсов.

Kubernetes Core Эксперт

Определяет стандарты Kubernetes-платформы для организации: архитектура multi-tenant кластеров, политики namespace-ов, стандарты деплоя через GitOps. Ревьюит Kubernetes-манифесты команд, проектирует self-service абстракции поверх K8s и определяет SLO для control plane и workload доступности.

Pulumi Эксперт

Определяет стратегию infrastructure-as-code с Pulumi для организации: устанавливает стандарты кодирования, фреймворки тестирования и governance библиотеки компонентов. Проводит архитектурные ревью сложных мультиоблачных развёртываний. Продвигает оптимизацию FinOps через enforcement политик и тегирование расходов.

Serverless Functions Эксперт

Определяет платформенную стратегию serverless, включая стандарты проектирования функций, паттерны деплоя и операционные runbook. Устанавливает FinOps-практики для оптимизации стоимости serverless. Ревьюит кросс-командные serverless-архитектуры на надёжность и безопасность.

Terraform Эксперт

Определяет стандарты Terraform для организации: структура репозиториев, конвенции именования ресурсов, стратегия разделения state. Внедряет Terraform Cloud/Enterprise для командной работы, ревьюит модули на безопасность и эффективность, проектирует процесс drift detection и автоматического remediation.

Определяет стратегию сетевой безопасности VPN и изоляции в организации: устанавливает стандарты шифрования, политики сегментации сети и governance подключений для гибридных сред. Проводит архитектурные ревью сложных мультисайтовых развёртываний. Продвигает внедрение zero-trust сетевых архитектур.

DevOps и CI/CD · 1

GitOps практики Эксперт

Стандартизирует infrastructure-as-code через GitOps: определяет repository structure и module strategy, создаёт infrastructure scaffolding tools, внедряет policy compliance в infrastructure PR review. Проектирует infrastructure change management process.

Тестирование и QA · 1

Chaos Engineering Эксперт

Определяет infrastructure resilience strategy: проектирует multi-region failover architecture validated через chaos, создаёт infrastructure chaos suite для continuous verification. Стандартизирует DR procedures и обеспечивает RTO/RPO compliance через regular testing.

Безопасность · 5

Определяет стандарты облачной безопасности для организации: baseline security controls для каждого account-типа, стандарты IAM-ролей, политики шифрования данных. Ревьюит security-архитектуру команд, внедряет security guardrails через SCPs и Terraform-модули, определяет SLO для time-to-remediate уязвимостей.

Определяет стандарты Kubernetes security для организации: политики Kyverno/OPA для всех кластеров, стандарты image admission, процесс security review для Helm-чартов. Внедряет security-as-code подход, ревьюит RBAC-матрицы команд и проектирует incident response процесс для Kubernetes-инцидентов.

Определяет стандарты сетевой безопасности организации: политики сегментации для всех сред, стандарты TLS-конфигурации, процессы firewall change management. Ревьюит сетевую архитектуру команд на соответствие zero-trust принципам, внедряет автоматический аудит network policies и определяет SLO для security patching.

Определяет стандарты application security на инфраструктурном уровне: политики WAF для всех публичных endpoint-ов, стандарты security headers, процесс реагирования на обнаруженные уязвимости. Ревьюит security-конфигурации команд и внедряет continuous security testing в инфраструктурные пайплайны.

Secrets Management Эксперт

Определяет стандарты secrets management для организации: архитектура namespace-ов Vault для multi-tenant, политики ротации и TTL секретов, процесс onboarding команд. Ревьюит Vault-политики и auth-конфигурации, проектирует self-service портал для управления секретами и сертификатами.

AI-ассистированная разработка · 1

GitHub Copilot Эксперт

Определяет стандарты использования AI-ассистентов в инфраструктурной команде: guidelines для Copilot с IaC-кодом, правила review AI-сгенерированных Terraform-модулей на security compliance. Внедряет custom instructions для инфраструктурного контекста и обучает команду эффективным промпт-паттернам для DevOps-задач.

Архитектура и проектирование · 2

Capacity Planning Эксперт

Определяет процесс capacity planning для организации: регулярные review утилизации ресурсов, прогнозные модели на основе бизнес-метрик, бюджетирование инфраструктуры на квартал. Внедряет автоматический мониторинг capacity через Prometheus-алерты и координирует планирование с командами разработки для новых запусков.

Disaster Recovery Design Эксперт

Определяет DR-стандарты для инфраструктуры организации: классификация сервисов по критичности (Tier 1-4), стандартные DR-паттерны для каждого tier-а, регулярные DR-drill-ы. Ревьюит DR-планы команд, внедряет automated failover testing и координирует ежеквартальные учения по восстановлению после сбоев.

Observability и мониторинг · 4

Определяет стандарты логирования для организации: единый формат structured logs, обязательные поля (trace_id, service, environment), политики retention по классам данных. Ревьюит logging-конфигурации команд, проектирует self-service доступ к логам и определяет SLO для log ingestion latency и availability.

OpenTelemetry Эксперт

Определяет стандарты distributed tracing для организации: обязательная инструментация для всех сервисов, стандарты span naming и attribute conventions, политики sampling. Внедряет OTel Operator для Kubernetes, ревьюит конфигурации команд и проектирует self-service onboarding для observability-стека.

Prometheus и Grafana Эксперт

Определяет стандарты мониторинга для организации: обязательные метрики (RED/USE методы), стандартные дашборды для каждого типа сервиса, процесс создания алертов с runbook-ами. Внедряет Grafana-as-a-service для self-service мониторинга, ревьюит alerting-правила команд и определяет SLO для monitoring infrastructure.

SLI / SLO / SLA Эксперт

Определяет SLO-стандарты для всей инфраструктуры: типовые SLI для каждого класса компонентов (compute, storage, network, DB), процесс negotiation SLO с командами. Внедряет SLO-driven prioritization для engineering работы, ревьюит SLO команд и координирует error budget policy с product management.

Контроль версий и коллаборация · 3

Определяет стандарты документации инфраструктуры для организации: обязательные разделы для каждого Terraform-модуля, шаблоны runbook-ов и playbook-ов, стандарты ADR. Внедряет docs-as-code pipeline с review-процессом, ревьюит документацию команд на полноту и координирует создание on-call handbook.

Code Review Эксперт

Определяет стандарты code review для инфраструктурной команды: чеклисты для различных типов изменений (network, compute, security), SLA на время review, escalation-процесс для критических изменений. Внедряет automated review через Danger.js и custom bots, координирует cross-team review для shared infrastructure.

Git Advanced Эксперт

Определяет стандарты Git для инфраструктурной организации: единая branching strategy для IaC-репозиториев, стандарты commit messages для automated changelog, политики protected branches. Внедряет GitOps-подход (ArgoCD, Flux) для Kubernetes и Terraform, ревьюит git-workflow-ы команд и определяет disaster recovery для git-репозиториев.

Дополнительные навыки

Команда их не оценивает, но они входят в самооценку и план развития.

Документирование APIИндексирование БДИнтеграционное тестированиеМногопоточное программированиеОсновы System DesignПаттерны проектированияПрактики безопасного кодаПринципы ООП и SOLIDТипобезопасность и системы типовChatGPT / ClaudeCursor IDEGitHub Actions / GitLab CIGraphQL DesignPrompt Engineering для кодаUnit-тестирование

Что меняется на Principal

0 навыков получают более высокое ожидание или становятся ключевыми при переходе с Lead на Principal. Сначала самые большие скачки.

Страница Principal →
Прогоните это со всей командой
Самооценка плюс оценка руководителя и коллег по одной матрице, зоны роста и готовность к следующему уровню для каждого инженера. Team Pro бесплатно 14 дней; личные инструменты бесплатны всегда.
Попробовать с командой (14 дней бесплатно) Отправить тимлиду

} в открытой матрице компетенций: 60 навыков на 5 уровнях. Матрица бесплатна для специалистов и останется бесплатной.