курс про то, как сделать систему наблюдаемой и надёжной: не просто «поставить мониторинг», а уметь по сигналам понять, что происходит внутри незнакомого запроса в проде. Разбираем три столпа observability (logs, metrics, traces), методологии RED/USE, SLI/SLO/SLA с error budget, алертинг без alert fatigue, on-call и постмортемы. Уровень Middle+ с прицелом на собеседования по SRE-практикам и реальную эксплуатацию распределённых систем.