Skip to content

Карта обучения DevOps, SRE и платформенной инженерии

JuniorMiddleSeniorОбзор ~18 мин

Трек объединяет DevOps, SRE и Platform Engineering: delivery создаёт поток изменений, SRE задаёт модель надёжности, а platform engineering делает безопасный путь доступным командам как продукт.

DEVOPS, SRE И ПЛАТФОРМЕННАЯ ИНЖЕНЕРИЯ

От операционной системы и доставки к надёжной платформе

Трек объединяет Linux, доставку, контейнеры, облака, наблюдаемость, SRE, безопасность и платформенную инженерию в единый эксплуатационный путь.

Темы
454
Разделы
18
Этапы
5
01

Освоить среду

Понять Linux, сети, Git, артефакты и автоматизацию.

LinuxСетиGitСценарии автоматизации
02

Построить доставку

Создать воспроизводимые конвейеры CI/CD и безопасные выпуски.

CICDАртефактыВыпуск
03

Управлять средой выполнения

Работать с контейнерами, Kubernetes, IaC и облачными ресурсами.

КонтейнерыKubernetesIaCОблака
04

Обеспечить надёжность

Проектировать наблюдаемость, SLO, безопасность, ресурсы и восстановление.

НаблюдаемостьSREБезопасностьDR
05

Создать платформу

Превратить повторяющиеся операции в возможности платформы самообслуживания.

ПлатформаСтандартные путиFinOpsЭксплуатация
Полный трек454 тем
01

Основы

Модель DevOps, автоматизация и системное мышление

22 тем
02

Эксплуатация Linux

Процессы, хранение, сервисы и диагностика

28 тем
03

Сети и DNS

Связность, маршрутизация, TLS и диагностика

26 тем
04

Git и артефакты

Контроль версий, сборки и реестры

20 тем
05

Непрерывная интеграция

Тесты, конвейеры и обратная связь

24 тем
06

Непрерывная доставка

Среды, развёртывание и откат

24 тем
07

Контейнеры

Образы, среда выполнения, изоляция и безопасность

28 тем
08

Kubernetes

Нагрузки, сети, хранение и эксплуатация

34 тем
09

Инфраструктура как код

Состояние, модули, политики и тестирование

28 тем
10

Конфигурация и секреты

Конфигурация среды и жизненный цикл секретов

20 тем
11

Основы облаков

Идентификация, сеть, вычисления, данные и регионы

28 тем
12

Наблюдаемость

Сигналы, телеметрия, оповещения и диагностика

30 тем
13

SRE и надёжность

SLI, SLO, бюджеты ошибок и отказоустойчивость

28 тем
14

Безопасность и цепочка поставки

Усиление защиты, политики, происхождение и SBOM

28 тем
15

Защита данных и аварийное восстановление

Резервирование, восстановление, RPO, RTO и непрерывность

20 тем
16

Производительность и ресурсы

Нагрузка, узкие места, масштабирование и стоимость

20 тем
17

Платформенная инженерия

IDP, самообслуживание и стандартные пути

24 тем
18

Эксплуатация и инциденты

On-call, response, learning и improvement

22 тем

Карта production-системы

Диаграмма

Как проходить трек

  1. Начните с Linux, сети, shell и Git; они нужны для диагностики любого runtime.
  2. Соберите воспроизводимый CI/CD pipeline с immutable artifact и rollback.
  3. Изучите containers до Kubernetes, затем разберите reconciliation и failure modes.
  4. Управляйте инфраструктурой и policy как кодом, включая state и recovery.
  5. Постройте telemetry, SLI/SLO и alerting до работы с incident scenarios.
  6. Закрепите знания через backup restore, game day и platform self-service.

Практические рубежи

ЭтапПрактикаКритерий
SystemsДиагностика Linux-сервисаПричина подтверждена метриками и системными данными
DeliveryCI/CD с canaryЕсть gates, health check и rollback
RuntimeKubernetes workloadОграничены ресурсы, права и blast radius
ReliabilitySLO и game dayAlert связан с пользовательским симптомом
PlatformGolden pathКоманда получает безопасный self-service с guardrails

Полная программа: progress.md.