Распродажа

Курс SRE: Практика построения и поддержки надежных систем

Первоначальная цена составляла 990 грн.Текущая цена: 390 грн.

-60%
Вы экономите: 600 грн (60%)
До конца акции:06дн03час42мин31сек

−20% при покупке от 2 курсовактивируется автоматически

Ваш сайт или сервис постоянно “падает”, а пользователи жалуются на медленную работу? Вы устали от хаотичного “тушения пожаров” вместо системной работы над надежностью? Без методологии SRE (Site Reliability Engineering) любой сложный проект превращается в постоянный источник стресса и непредсказуемых сбоев. Этот практический курс погрузит вас в реальные задачи SRE-инженера. Вы научитесь строить, ломать и восстанавливать микросервисную архитектуру, управлять бюджетом ошибок (error budget), настраивать эффективный мониторинг и реагировать на инциденты, чтобы обеспечить максимальную надежность и удовлетворенность пользователей.

Чему вы научитесь
  • Формулировать и отслеживать ключевые показатели надежности: SLO, SLI, SLA.
  • Проектировать отказоустойчивые распределенные системы и планировать их мощность.
  • Настраивать мониторинг (Prometheus, Grafana) и систему оповещений (alerting).
  • Эффективно реагировать на инциденты, проводить постмортемы и автоматизировать процессы.
Для кого этот курс
  • DevOps-инженеры, желающие перейти в SRE.
  • Системные администраторы и разработчики, ответственные за инфраструктуру.
  • Технические лидеры, стремящиеся повысить надежность своих продуктов.
Требования
  • Свободное владение Linux.
  • Опыт программирования на любом языке на уровне Junior.
  • Навыки работы с GitLab, Prometheus и Kubernetes.
Курс содержит

10 часов видео

3 урока

68 дополнительных материалов

Онлайн и в удобном для вас темпе

Полный пожизненный доступ

Цифровой сертификат об окончании

Add to Cart
Курс SRE - видеозапись
Курс SRE: Практика построения и поддержки надежных систем
990 грн Первоначальная цена составляла 990 грн.390 грнТекущая цена: 390 грн.
Покупка занимает минуту
  1. Добавляете курс в корзину.
  2. Вводите почту и пароль — это ваш аккаунт, в нём курс будет храниться постоянно.
  3. Оплачиваете любым удобным способом — их больше восьми.
  4. Курс сразу открывается в аккаунте, ссылка дублируется на почту.

Доступ навсегда: вернуться к курсу можно и через год. Вопросы — чат на сайте или info@siluette.com.ua.

Станьте инженером, который не чинит, а предотвращает проблемы

Site Reliability Engineering (SRE) — это подход, разработанный в Google, который рассматривает задачи эксплуатации как программную проблему. На этом курсе вы выйдете за рамки традиционного администрирования и DevOps. Вы научитесь мыслить категориями надежности, доступности и производительности, применяя инженерные практики для создания самовосстанавливающихся и масштабируемых систем.

Четыре этапа погружения в SRE

Программа курса построена вокруг четырех ключевых действий, отражающих жизненный цикл работы над любым сервисом:

  1. Строить: Вы сформулируете показатели SLO/SLI/SLA для сайта, разработаете архитектуру, настроите CI/CD, мониторинг и алертинг.
  2. Ломать: Вы будете имитировать реальные проблемы — от ошибок кода и отказов инфраструктуры до DoS-атак, изучая пределы устойчивости системы с помощью практик Chaos Engineering.
  3. Чинить: Вы научитесь организовывать процесс ликвидации аварий в сжатые сроки, управлять стрессом, координировать команду и правильно коммуницировать со стейкхолдерами.
  4. Изучать: Вы будете анализировать инциденты, проводить blameless-постмортемы и принимать решения по предотвращению проблем в будущем через автоматизацию и улучшение архитектуры.
? Подробная программа курса

Тема 1: Основы SRE

Отличия DevOps vs SRE, понятия SLI, SLO, SLA и Error budget.

Тема 2-4: Дизайн и запуск систем

Архитектура микросервисов, Design for failure, чек-лист приемки проекта, логирование, метрики, трейсинг, CI/CD, capacity planning.

Тема 5: Мониторинг и Alerting

Monitoring vs. Observability, настройка Prometheus, 4 золотых сигнала, Black-Box vs. White-Box мониторинг.

Тема 6-8: Тестирование надежности и управление нагрузкой

Failure-injection (Chaos Monkey), балансировка нагрузки, retry, timeout, circuit breaker, защита от DDoS.

Тема 9-12: Реагирование на инциденты и развитие

Практика On-Call, протоколы управления инцидентами, диагностика, отладка, постмортемы, Canary release, разбор реальных кейсов.

Присоединяйтесь к курсу, чтобы научиться строить системы, которыми гордятся разработчики и которые любят пользователи.

Отзывы покупателей

  1. Максим

    18.09.2025 Подтвержденный клиент

    Chaos Monkey - это было для меня открытием! Ломать свой продакшн, чтобы сделать его сильнее - это гениально. Очень крутой подход.

  2. Ирина

    28.02.2025 Подтвержденный клиент

    Очень глубокий и серьезный курс. Для тех, кто уже работает админом, но хочет расти. SRE - это будущее.

  3. Юлия

    13.06.2024 Подтвержденный клиент

    Я разработчик, и этот курс помог мне лучше понимать девопсов. Теперь мы разговариваем на одном языке. И я начал писать более "operability-friendly" код.

Показано 3 из 3

Оставить отзыв