Перейти к содержимому

SRE Engineering

Здесь всё, что можно закоммитить: код, инфраструктура, инструменты наблюдаемости и автоматизации. Главный объект работы — сама система, а не договорённости вокруг неё и не порядок действий дежурного.

В ветвь входят наблюдаемость (observability), управление SLI/SLO/SLA, снижение toil, chaos engineering, capacity planning — то, что делает систему надёжной по построению, а не героизмом дежурного.

У каждой компетенции своя страница: там описание, инвентарь L2-концептов домена и практики, которые к ней относятся. В инвентаре видно, что уже расписано листом, а что пока только названо. Конкретный тулинг (Prometheus, Terraform, k6 и т.п.) в графе не присутствует — он живёт в секции «Материалы» соответствующего листа. Подробнее — в Методологии.