Observability, как в BigTech

69 участников

О чём курс

Системы мониторинга, которые годами требуют ресурсы, но не помогают найти причину сбоя — это головная боль многих команд, которую здесь лечат через практики уровня BigTech. Вместо накопления «сырых» данных вы научитесь настраивать Observability так, чтобы инциденты закрывались за минуты, а бизнес-показатели были прозрачны для руководства.

Внутри курса разбирается работа с метриками, логами и трейсами в связке с инструментами Prometheus, Grafana Loki и Jaeger. Вы поймете, как инструментировать сервисы, создавать информативные дашборды без лишнего шума и грамотно настраивать алертинг, чтобы реагировать только на критические ситуации. Материал ориентирован на SRE-инженеров и разработчиков, которые хотят перестать «тушить пожары» и начать управлять стабильностью систем на основе данных.

Программа обучения

  • Урок 1. Введение в Observability
  • Урок 2. Метрики: основные концепции и работа с ними
  • Урок 3. Хранилища метрик и их выбор
  • Урок 4. Визуализация и управление метриками
  • Урок 5. Логирование и структурированные логи
  • Урок 6. Трейсинг
  • Урок 7. Оптимизация наблюдаемости и оптимизация сервисов
  • Урок 8. Управление алертингом
  • Урок 9. Использование метрик для управления поведением приложения
  • Урок 10. Observability как часть SRE — практики и проблемы эксплуатации
  • Урок 11. Стратегии для больших систем
Складчина создана 21 февраля 2025 г. · описание обновлено 23 марта 2026 г.

Другие материалы автора 1

ВЛ Виталий Лихачев Все материалы
1 196 ₽ 34 860 ₽