Применяет алгоритмическое мышление к управлению инфраструктурой: алгоритмы балансировки нагрузки для распределения трафика, алгоритмы планирования ёмкости для прогнозирования ресурсов, алгоритмы оптимизации маршрутизации сети. Проектирует эффективные алгоритмы provisioning для автоматизации инфраструктуры с разрешением зависимостей.
Роли · Infrastructure Engineer · Senior
Что должен уметь Senior }
45 ключевых навыков, всего 60. Ожидания по каждому навыку и что меняется на следующем уровне.
На этой странице — что ожидается от Senior }, навык за навыком. Ключевые навыки оценивают руководитель и коллеги в цикле ревью; остальные учитываются только в самооценке. Основные области: Основы программирования, Backend Development, Базы данных.
Ключевые навыки для Senior
Сгруппированы по областям. Метка справа — ожидаемая глубина: Осведомлённость, Применение, Продвинутый или Эксперт.
Основы программирования · 4
Проектирует async-архитектуры для автоматизации инфраструктуры: конкурентное управление множеством хостов, async-деплой конфигурации в масштабе, неблокирующий мониторинг инфраструктуры. Менторит команду по async-паттернам для надёжных операций инфраструктуры.
Проектирует стандарты качества кода для автоматизации инфраструктуры: структура Ansible-плейбуков, конвенции модулей Pulumi/Terraform, фреймворки тестирования инфраструктуры. Рефакторит сложные скрипты provisioning в декларативные, идемпотентные модули. Устанавливает практики ревью для минимизации blast radius и безопасности откатов.
Выбирает оптимальные структуры данных для управления инфраструктурой: графовые структуры для моделирования сетевой топологии, древовидные структуры для иерархий DNS и LDAP, модели данных временных рядов для планирования ёмкости. Оптимизирует структуры конфигурационных данных для быстрого provisioning и откатов. Проектирует эффективные модели данных для отслеживания активов инфраструктуры и маппинга зависимостей.
Backend Development · 3
Администрирует Kafka-кластеры как часть инфраструктуры: настройка репликации, мониторинг consumer lag, оптимизация partition-стратегии. Автоматизирует управление топиками через Terraform-провайдер, обеспечивает отказоустойчивость брокеров и настраивает алерты на деградацию производительности.
Разрабатывает внутренние API и веб-интерфейсы для инфраструктурных сервисов на Flask/FastAPI: self-service порталы провизионирования, API-обёртки над Terraform и Ansible, дашборды мониторинга. Интегрирует Python-бэкенды с облачными SDK и системами конфигурационного управления.
Управляет Redis-инфраструктурой: настройка Sentinel и Redis Cluster, оптимизация памяти через eviction-политики, мониторинг латентности операций. Автоматизирует деплой Redis через Ansible/Terraform, настраивает персистентность данных и алерты на исчерпание памяти.
Базы данных · 3
Проектирует инфраструктуру для multi-region реплицированных кластеров БД: сетевая топология для low-latency репликации, архитектура хранилищ, автоматический DR failover. Оптимизирует затраты при соблюдении RPO/RTO SLA. Менторит команду по HA-паттернам.
Проектирует multi-region архитектуры disaster recovery с автоматическими процедурами failover и failback. Реализует infrastructure-as-code для топологии backup, обеспечивая консистентность сред. Оптимизирует целевые RTO/RPO через многоуровневые стратегии и проводит chaos engineering для валидации DR.
Проектирует отказоустойчивую инфраструктуру PostgreSQL: настройка Patroni для автоматического failover, конфигурация PgBouncer для connection pooling, WAL-архивация в S3. Оптимизирует параметры ядра ОС и файловой системы под PostgreSQL, планирует capacity для IOPS и storage.
API и интеграции · 1
Проектирует REST API для внутренних инфраструктурных сервисов: API провизионирования ресурсов, endpoint-ы self-service портала, webhook-и для GitOps. Интегрирует множество API (cloud providers, Vault, Terraform) в единый automation workflow с корректной обработкой ошибок и идемпотентностью.
Облако и инфраструктура · 17
Проектирует архитектуру балансировки нагрузки для высоконагруженных систем: ECMP routing, DPDK-ускоренное проксирование и глобальная балансировка (GSLB). Оптимизирует для минимальной задержки с пулингом соединений, тюнингом keep-alive и аппаратной разгрузкой.
Проектирует сложные сетевые архитектуры: Transit Gateway для hub-and-spoke топологии, VPC peering между регионами, Direct Connect/Interconnect для гибридных сценариев. Оптимизирует маршрутизацию трафика, настраивает advanced DNS (GeoDNS, failover routing) и проектирует сегментацию сети для compliance.
Проектирует комплексную систему безопасности контейнеров: runtime-сканирование через Falco, admission controller в Kubernetes для проверки образов, SBOM-генерация через Syft. Настраивает автоматический патчинг базовых образов и интеграцию результатов сканирования с SIEM-системой.
Проектирует архитектуру автоматизации Ansible для управления корпоративной инфраструктурой в дата-центрах и облачных средах. Внедряет продвинутые паттерны — кастомные connection-плагины для сетевых устройств, callback-плагины для интеграции с ITSM и workflow Tower/AWX для мультистадийного провижининга инфраструктуры. Оптимизирует Ansible для масштабных операций инфраструктуры через performance tuning, кастомные inventory-плагины и интеграцию с базами данных управления конфигурацией для трекинга compliance.
Проектирует production-grade AWS-архитектуру: multi-AZ и multi-region развёртывание, Transit Gateway для сетевой связности, Organization с SCPs для multi-account стратегии. Оптимизирует стоимость через Reserved Instances и Savings Plans, настраивает AWS Config для compliance и GuardDuty для security monitoring.
Проектирует инфраструктурные решения с CDN и Edge Computing. Оптимизирует стоимость и производительность. Внедряет best practices и security hardening.
Проектирует мультиоблачные Crossplane Compositions с оптимизацией стоимости через ресурсные патчи. Реализует ротацию ProviderConfig для безопасности учётных данных. Строит Composition pipelines с валидационными webhook и обнаружением дрифта.
Проектирует корпоративную Docker-инфраструктуру: стандарты базовых образов с hardening, multi-arch builds, настройка Docker BuildKit с кэшированием в S3. Оптимизирует runtime-конфигурацию containerd, настраивает storage drivers для высоких нагрузок и интеграцию с корпоративным PKI для подписи образов.
Проектирует конфигурации парка Envoy с продвинутой балансировкой нагрузки (ring hash, Maglev) и circuit breaking. Реализует rate limiting с внешними gRPC-сервисами и кастомными Lua/Wasm-фильтрами. Ужесточает настройки mTLS с интеграцией SDS и ротацией сертификатов.
Проектирует инфраструктурные решения с Helm. Оптимизирует стоимость и производительность. Внедряет best practices и security hardening.
Проектирует мультикластерные развёртывания Istio с продвинутым управлением трафиком. Реализует политики mTLS и правила авторизации для сети нулевого доверия. Оптимизирует потребление ресурсов Envoy proxy и задержки.
Проектирует инфраструктурные решения с Kubernetes Advanced. Оптимизирует стоимость и производительность. Внедряет best practices и security hardening.
Проектирует production-grade Kubernetes-инфраструктуру: развёртывание кластеров через kubeadm/kOps/EKS, настройка CNI (Calico, Cilium), конфигурация etcd для отказоустойчивости. Оптимизирует scheduler, настраивает PodDisruptionBudget и topologySpreadConstraints, проектирует стратегию обновления кластеров.
Проектирует enterprise-решения инфраструктуры с Pulumi: мультиаккаунтные архитектуры, кастомные resource providers и Automation API для self-service платформ. Оптимизирует облачные расходы через автоматизацию right-sizing и политики жизненного цикла ресурсов. Внедряет CrossGuard и security hardening.
Проектирует production-grade serverless-инфраструктуру с multi-region failover, обработкой DLQ и observability. Оптимизирует производительность и стоимость функций через right-sizing и provisioned concurrency. Реализует security hardening и least-privilege IAM.
Проектирует модульную Terraform-архитектуру: переиспользуемые модули для сетей, кластеров, баз данных, workspace-стратегия для окружений. Настраивает Terragrunt для DRY-конфигураций, внедряет policy-as-code через OPA/Sentinel, оптимизирует время plan/apply для больших state-файлов.
Проектирует enterprise-архитектуры VPN и сетевой изоляции: мультирегиональные mesh-топологии, zero-trust network access с ZTNA-шлюзами и гибридное облачное подключение через dedicated interconnects. Оптимизирует пропускную способность и задержки. Внедряет security hardening с certificate pinning и интеграцией MFA.
DevOps и CI/CD · 1
Проектирует infrastructure GitOps: настраивает Crossplane для Kubernetes-native infrastructure management, реализует drift detection и reconciliation для infrastructure state. Проектирует multi-account/multi-region infrastructure через GitOps с proper state management.
Тестирование и QA · 1
Проектирует infrastructure resilience testing: создаёт automated DR drills, тестирует backup/restore procedures под нагрузкой, реализует region failover experiments. Настраивает infrastructure monitoring для detection chaos impact и automatic rollback.
Безопасность · 5
Проектирует security-архитектуру облачной инфраструктуры: multi-account стратегия с security hub, centralized logging через CloudTrail + S3 + Athena, GuardDuty для threat detection. Внедряет CSPM (Cloud Security Posture Management), настраивает автоматическое remediation через Lambda и проектирует cross-account access patterns.
Проектирует комплексную безопасность Kubernetes: admission controllers (OPA Gatekeeper, Kyverno) для policy enforcement, runtime security через Falco, network segmentation через Cilium NetworkPolicy. Настраивает audit logging, encrypts secrets at rest через KMS-провайдер и проектирует workload identity для облачных сервисов.
Проектирует сетевую безопасность enterprise-уровня: micro-segmentation через Cilium/Calico NetworkPolicy, mTLS для service-to-service коммуникации, DDoS-защита через AWS Shield/CloudFlare. Внедряет network detection and response (NDR), настраивает deep packet inspection и проектирует secure connectivity для гибридного облака.
Проектирует инфраструктурную защиту от OWASP-уязвимостей: многоуровневый WAF с custom rules, rate limiting на уровне ALB и nginx, защита от SSRF через сетевую сегментацию. Внедряет автоматическое сканирование DAST для инфраструктурных сервисов и настраивает ModSecurity с OWASP Core Rule Set.
Проектирует production-grade Vault-инфраструктуру: HA-кластер с Raft storage, auto-unseal через AWS KMS, disaster recovery через replication. Настраивает dynamic secrets для всех баз данных и облачных провайдеров, внедряет Vault Agent для прозрачной инъекции секретов в Kubernetes-поды.
AI-ассистированная разработка · 1
Применяет AI-инструменты для сложных инфраструктурных задач: генерация boilerplate для Terraform-провайдеров, рефакторинг Ansible-ролей, создание unit-тестов для IaC через Terratest. Знает ограничения Copilot для HCL/YAML и корректирует промпты с учётом специфики облачных API и сетевых конфигураций.
Архитектура и проектирование · 2
Проводит capacity planning для инфраструктурных компонентов: прогнозирование нагрузки на основе исторических метрик, планирование роста Kubernetes-кластеров, расчёт IOPS для storage-подсистемы. Строит модели потребления ресурсов (CPU, RAM, network bandwidth) и определяет точки масштабирования для критических сервисов.
Проектирует disaster recovery для критической инфраструктуры: multi-AZ архитектура с автоматическим failover, бэкап стратегия с cross-region репликацией, runbook-и для восстановления. Настраивает автоматическое тестирование DR через chaos engineering (Chaos Monkey, Litmus), определяет RPO/RTO для каждого компонента.
Observability и мониторинг · 4
Проектирует production-grade logging-инфраструктуру: multi-tenant ELK-кластеры, Loki с S3-backend для cost-effective хранения, Kafka как buffer для пиковых нагрузок. Оптимизирует стоимость хранения через tiered storage, настраивает correlation ID для трейсинга через логи и проектирует алерты на аномалии в log patterns.
Проектирует production-grade OTel-архитектуру: multi-layer collector topology (agent → gateway → backend), tail-based sampling для intelligent фильтрации, батчинг и ретраи. Настраивает correlation между traces/metrics/logs, оптимизирует ресурсопотребление collector-ов и интегрирует OTel с service mesh telemetry.
Проектирует масштабируемую Prometheus-инфраструктуру: federation для multi-cluster мониторинга, Thanos/Cortex для long-term storage и global query, высокодоступный Alertmanager. Оптимизирует cardinality метрик, настраивает recording rules для производительности запросов и проектирует Grafana dashboards-as-code через Jsonnet.
Проектирует SLO-фреймворк для инфраструктурной платформы: каскадные SLO от инфраструктуры к сервисам, composite SLI для сложных систем, автоматический расчёт error budget. Внедряет SLO-as-code через Sloth или OpenSLO, настраивает automated incident creation при breach и интегрирует SLO с capacity planning.
Контроль версий и коллаборация · 3
Проектирует систему документации инфраструктуры: автогенерация из IaC-кода (terraform-docs, ansible-doc), живые architecture diagrams через Mermaid/D2, интеграция с service catalog. Внедряет documentation testing (broken links, schema validation), создаёт шаблоны для postmortem-ов и проектирует knowledge base для on-call инженеров.
Проводит архитектурные review инфраструктурного кода: оценка Terraform module design, анализ networking topology changes, проверка DR-способности конфигураций. Автоматизирует review через Atlantis/Spacelift для terraform plan в PR, внедряет automated policy checks и менторит junior-инженеров через конструктивный feedback.
Проектирует Git-workflow для инфраструктурных репозиториев: monorepo vs polyrepo стратегия для Terraform, GitOps branching model для Kubernetes-манифестов, automated release pipeline. Настраивает CODEOWNERS для критических конфигураций, git-crypt для шифрования секретов и оптимизирует работу с large state files.
Дополнительные навыки
Команда их не оценивает, но они входят в самооценку и план развития.
Что меняется на Lead
60 навыков получают более высокое ожидание или становятся ключевыми при переходе с Senior на Lead. Сначала самые большие скачки.
- Алгоритмы и сложность: Продвинутый → Эксперт
- Асинхронное программирование: Продвинутый → Эксперт
- Балансировка нагрузки: Продвинутый → Эксперт
- Безопасность облачной инфраструктуры: Продвинутый → Эксперт
- Безопасность Kubernetes: Продвинутый → Эксперт
- Документация как код: Продвинутый → Эксперт
- Качество кода и рефакторинг: Продвинутый → Эксперт
- Основы сетей: Продвинутый → Эксперт
- Репликация и High Availability: Продвинутый → Эксперт
- Сетевая безопасность: Продвинутый → Эксперт
} в открытой матрице компетенций: 60 навыков на 5 уровнях. Матрица бесплатна для специалистов и останется бесплатной.