Скачать курс «SRE: data-driven подход к управлению надёжностью систем» — Селиванов П., Федорков В., Лакосников П., Гусев М., Бухаров С. | Отзывы | Складчина

SRE: data-driven подход к управлению надёжностью систем

0/5 ·
Создан: 5 мая 2021 г. Обновлён: 2 мая 2026 г.

Курс «Проектирование надежности сайта — Site Reliability Engineering» от Slurm представляет собой интенсивную программу, направленную на освоение data-driven подхода к управлению надежностью сложных систем. SRE (Site Reliability Engineering) — это методология, которая решает задачи, схожие с DevOps, но с фокусом на обеспечение стабильности сервисов. Основная цель курса — научить инженеров и разработчиков минимизировать время простоя, сокращать количество ошибок и делать бизнес, опирающийся на информационные системы, более устойчивым и предсказуемым. Программа ориентирована на тех, кто хочет перестать работать в режиме «пожарной команды» и перейти к системному управлению надежностью.

Обучение построено на глубокой практике. Участники работают с учебным проектом — сайтом по продаже билетов в кинотеатры, состоящим из набора микросервисов. В ходе интенсива студенты проходят полный цикл жизни SRE-инженера: от проектирования архитектуры и настройки мониторинга до ликвидации аварий и проведения постмортемов. Вы научитесь формулировать показатели SLO, SLI и SLA, разрабатывать инфраструктуру, способную их поддерживать, и настраивать алертинг, который действительно помогает, а не создает «шум». Особое внимание уделяется управлению инцидентами: участники тренируются работать под давлением, выстраивать приоритеты и эффективно взаимодействовать с командой и стейкхолдерами в условиях ограниченного времени.

Курс дает возможность не только изучить теорию, но и применить её на практике: вы будете «ломать» систему, имитируя ошибки разработчиков, отказы инфраструктуры и DoS-атаки, а затем «чинить» её, анализируя причины сбоев и внедряя изменения в архитектуру и процессы. Вы узнаете, как правильно проводить онбординг проектов в SRE-команды, как настраивать Health Checking в Kubernetes и как внедрять канареечные релизы. Программа сформирована экспертами из ведущих мировых и российских компаний, таких как Google, Booking, Databricks, Яндекс и других, что гарантирует актуальность знаний и их применимость в реальных условиях.

Для успешного прохождения обучения участникам потребуются навыки работы с Linux, Kubernetes и базовое знание Python для решения кейсов. Если навыков программирования недостаточно, предусмотрена работа в командах, где экспертиза распределяется между участниками. Формат обучения включает теоретические модули, практические кейсы, разборы с экспертами и регулярные AMA-сессии, где можно получить ответы на любые вопросы. По итогам курса вы получите четкое понимание того, как снизить ущерб от отказов, как правильно собирать метрики, как быстро восстанавливать продакшн и как выстроить процессы, которые сделают ваш сервис надежным и масштабируемым.

0 · 0 отзывов

Отзывов пока нет. Будьте первым!

Ещё интересные курсы

Б
156 ₽ 5 000 ₽ −97%
5.0

Биржевые миллионы. Я - инвестор

Олег Макаров
S
284 ₽ 7 600 ₽ −96%

SEO продвижение сайтов и интернет-маркетинг

Как помочь своему ребенку: самоопределение, воля, успех, выбор профессии
156 ₽ 2 500 ₽ −94%

Как помочь своему ребенку: самоопределение, воля, успех, выбор профессии

Ирина Млодик
Твори реальность со скоростью Света
80 ₽ 599 ₽ −87%
2.0

Твори реальность со скоростью Света

Ливанда
Наколка на манекене в вашей практике
80 ₽ 1 000 ₽ −92%

Наколка на манекене в вашей практике

Selftailor
Ораторское мастерство. Практическое руководство: 8 ключевых навыков
600 ₽ 7 080 ₽ −92%

Ораторское мастерство. Практическое руководство: 8 ключевых навыков

Иван Гладырь
Первый шаг к хлебу на закваске Предзаказ
472 ₽ 1 950 ₽ −76%

Первый шаг к хлебу на закваске

Инна Горобец