← Все навыки

Observability и надёжность

курс про наблюдаемость и надёжность: три столпа — логи, метрики и трейсы, стек Prometheus, Grafana и Loki, и практики SRE: SLO, алертинг и разбор инцидентов.

5 модулей, 13 тем Middle+ Индивидуально с ментором

Программа

Вводный модуль

  • О курсе и как с ним работать

Модуль 1. Три столпа: логи, метрики, трейсы

  • Observability против мониторинга
  • Метрики
  • Логи
  • Трейсы

Модуль 2. Prometheus, Grafana, Loki

  • Prometheus: модель и сбор метрик
  • PromQL: запросы к метрикам
  • Grafana: дашборды и визуализация
  • Loki: логи в стеке

Модуль 3. SRE: SLO, алертинг, надёжность

  • SLI, SLO и error budget
  • Алертинг
  • Инциденты, надёжность и постмортемы

Модуль 4. Вопросы с собеседований

  • Вопросы с собеседований по темам курса

Что разбираем

  • Observability против мониторинга, метрики, логи, трейсы
  • Prometheus — модель данных и сбор метрик, запросы на PromQL, дашборды в Grafana, Loki в стеке логов
  • SLI, SLO и error budget, алертинг, работа с инцидентами и постмортемы
  • Вопросы с собеседований по темам курса

Как проходит обучение

  • Занятия один на один с ментором под ваш темп и пробелы
  • Материалы курса открываются в личном кабинете, практику разбираете на встречах
  • Программа собирается под цель: подготовка к собеседованию или рабочая задача