курс про наблюдаемость и надёжность: три столпа — логи, метрики и трейсы, стек Prometheus, Grafana и Loki, и практики SRE: SLO, алертинг и разбор инцидентов.
5 модулей, 13 темMiddle+Индивидуально с ментором
Программа
Вводный модуль
О курсе и как с ним работать
Модуль 1. Три столпа: логи, метрики, трейсы
Observability против мониторинга
Метрики
Логи
Трейсы
Модуль 2. Prometheus, Grafana, Loki
Prometheus: модель и сбор метрик
PromQL: запросы к метрикам
Grafana: дашборды и визуализация
Loki: логи в стеке
Модуль 3. SRE: SLO, алертинг, надёжность
SLI, SLO и error budget
Алертинг
Инциденты, надёжность и постмортемы
Модуль 4. Вопросы с собеседований
Вопросы с собеседований по темам курса
Что разбираем
Observability против мониторинга, метрики, логи, трейсы
Prometheus — модель данных и сбор метрик, запросы на PromQL, дашборды в Grafana, Loki в стеке логов
SLI, SLO и error budget, алертинг, работа с инцидентами и постмортемы
Вопросы с собеседований по темам курса
Как проходит обучение
Занятия один на один с ментором под ваш темп и пробелы
Материалы курса открываются в личном кабинете, практику разбираете на встречах
Программа собирается под цель: подготовка к собеседованию или рабочая задача