трек

Наблюдаемость

Метрики, логи, трейсы. Что смотреть, когда продакшн молчит.

01 теория
Метрики, логи, трейсы

Три типа сигналов наблюдаемости: на какой вопрос отвечает каждый и когда какой смотреть.

11 мин · средне
02 теория
Уровни логирования и структурные логи

DEBUG/INFO/WARN/ERROR, зачем уровни, structured logging в JSON и что нельзя писать в логи.

10 мин · просто
03 теория
Метрики и Prometheus

Как Prometheus снимает метрики: pull-модель, типы метрик, /metrics эндпоинт и зачем нужны лейблы.

12 мин · средне
04 теория
Grafana: дашборды и панели

Зачем визуализировать метрики, как устроены дашборды и панели и почему хороший дашборд отвечает на вопрос, а не показывает всё подряд.

10 мин · средне
05 теория
Алерты: правила и Alertmanager

Как метрики превращаются в оповещения: правила алертов, маршрутизация и группировка в Alertmanager, борьба с шумом.

11 мин · средне
06 теория
SLI, SLO и error budget

Как измерять надёжность числами: SLI как метрика качества, SLO как цель и error budget как право на риск.

11 мин · средне