Тестирование отказоустойчивости систем (Chaos Engineering)
Курс учебного центра Слёрм по тестированию отказоустойчивости систем методами Chaos Engineering. Программа: история и развитие методологии, доступность системы и антихрупкость, основные принципы и этапы, категории неисправностей от инфраструктуры и ресурсов до ошибок на уровне людей и культуры, обзор инструмента Chaos Mesh с дашбордом, расписанием экспериментов, наборами операций и сбоями подов, DNS и HTTP, обзор Litmus с порядком запуска, веб-консолью и пробами, восемь практических кейсов и бонусная тема про связь методологии с бизнес-целями и чек-лист внедрения. Уровень: специалист среднего и старшего уровня и выше. Необходимые знания: Linux на уровне администратора, чтение кода на Go или Python, понимание работы сети, опыт работы в кластере Kubernetes или знание принципов, Docker и базовое понимание микросервисной архитектуры. Спикеры: Денис Воронов, руководитель группы инженеров платформы разработки, и Кирилл Пономарёв, руководитель направления разработки платформы для Chaos Engineering. Документ: именное свидетельство при 80% прохождения. Цена в каталоге: 30 000 рублей, в рассрочку от 7 500 рублей в месяц. На странице школы тариф «Видеокурс» с доступом на 2 года и свидетельством стоит 30 000 рублей единовременно или 7 500 рублей в месяц на четыре месяца.
Мнение редакции
Chaos Engineering это дисциплина, о которой в России много говорят и мало кто учит системно. Курс Слёрма закрывает эту нишу целиком: он объясняет, откуда методология взялась, какие бывают категории неисправностей, как формулируется гипотеза, и сразу показывает два конкретных инструмента, Chaos Mesh и Litmus, а не оставляет читателя с общими рассуждениями про антихрупкость.
Самая практичная часть это шестая тема с восемью кейсами. Там нет ничего абстрактного: удаление подов, нагрузочное тестирование подов, принудительная остановка контейнера, нагрузка на память хоста, заполненный диск, расхождение системных часов, недоступная сеть хоста и сборка всего этого в последовательность действий. Каждый из этих сценариев рано или поздно происходит сам, и разница только в том, застанет он команду в среду днём или в субботу ночью.
Отдельно стоит отметить бонусную тему про бизнес. Она отвечает на вопрос, который обычно и хоронит внедрение: зачем компании платить за то, чтобы что-то ломать. В курсе есть и разбор эффектов относительно бизнес-целей, и чек-лист внедрения, то есть материал для разговора с руководством. Минусы у курса организационные: объём в часах не назван вообще, а обратной связи в тарифе для частного студента нет, проверка заданий, менторы и чат вынесены в корпоративный формат с договорной ценой.
Плюсы
- тема, по которой на русском языке почти нет системных программ: методология разобрана от истории и принципов до внедрения
- два инструмента вместо одного: Chaos Mesh и Litmus разбираются отдельными темами с дашбордами, расписаниями и пробами
- восемь практических кейсов из реальной жизни: удаление подов, нагрузка на память, заполненный диск, расхождение часов, недоступная сеть хоста
- бонусная тема про бизнес: эффекты относительно бизнес-целей и чек-лист внедрения, с которым можно идти к руководству
- спикеры из платформенной разработки, один из них руководит разработкой платформы для Chaos Engineering
- есть бесплатный вебинар про первые эксперименты, по которому можно оценить подачу до покупки
Минусы
- объём курса нигде не назван: ни часов теории и практики, ни числа заданий страница не приводит
- в базовом тарифе нет ни проверки заданий, ни менторов, ни чата: всё это вынесено в формат для большой команды с договорной ценой
- оба разбираемых инструмента работают в Kubernetes, и вне кластера от курса останется только методологическая часть
- ни гарантии возврата денег, ни налогового вычета, ни помощи с трудоустройством страница курса не упоминает
Кому подходит
Инженерам по надёжности и специалистам по мониторингу
Первая группа в списке школы. Для них курс превращает набор разрозненных учений в методологию с гипотезами, этапами и инструментами, а восемь кейсов ложатся прямо в план тренировок.
Инженерам инфраструктурных платформ
Тем, кто отвечает за платформу, на которой работают продуктовые команды. Chaos Mesh и Litmus живут в Kubernetes, и внедрять их обычно приходится именно платформенной команде.
Архитекторам и разработчикам среднего и старшего уровня
Школа называет и тех и других. Для разработчика ценность в категориях неисправностей: становится видно, какие отказы приложение обязано пережить само, а какие лечатся инфраструктурой.
Руководителям и техническим лидерам
Для них в курсе есть отдельная бонусная тема про бизнес-эффекты и чек-лист внедрения, а также аргументы, чем оборачивается обнаружение сбоя не в тестировании, а в эксплуатации.
Кому курс не подойдёт
- тем, кто только осваивает Kubernetes: школа требует опыт работы в кластере или знание принципов, Linux на уровне администратора и умение читать код на Go или Python
- командам без мониторинга: эксперимент имеет смысл, когда есть чем измерить последствия, иначе это просто поломка продакшена
- тем, у кого нагрузка не в кластере: оба инструмента курса работают в Kubernetes, и вне его останется только методология
Чем отличается от других курсов направления
Прямых конкурентов по теме в каталоге нет: направление «Программирование», в котором лежит курс, заполнено программами про нейросети и вайбкодинг у Нетологии и TeachMeSkills. Внутри линейки Слёрма ближайшие соседи это курсы про надёжность и наблюдаемость, но они отвечают на вопрос, как увидеть проблему, а этот на вопрос, как найти её первым и специально. Отличие от общих курсов по SRE в узости: здесь нет ни дежурств, ни бюджетов ошибок, зато есть два инструмента и восемь готовых сценариев, которые можно повторить у себя на следующей неделе.
Обзор курса
Кто стоит за курсом
Спикеров двое, и оба из практики платформенной разработки. Денис Воронов, руководитель группы инженеров платформы разработки и направления DevOps, более 15 лет в IT в инфраструктуре, администрировании и процессах, развивает корпоративную платформу и внедряет новые практики. Кирилл Пономарёв, руководитель направления разработки платформы для Chaos Engineering, спикер конференции DevOpsConf. Второй профиль здесь особенно важен: человек не просто применял методологию, а строил платформу под неё, и такие люди знают, где инструменты ломаются.
Как устроена нагрузка
Формат самостоятельный: видеоуроки с доступом 2 года, старт в любой момент, практические задания. Курс разбит на семь тем, внутри каждой от трёх до восьми уроков. Общей длительности школа не называет, часов теории и практики страница тоже не приводит, поэтому спланировать нагрузку заранее нельзя. По количеству уроков и кейсов курс выглядит как несколько недель в спокойном темпе.
Что входит в стоимость
Тариф на странице один, «Видеокурс»: видеоуроки с доступом на 2 года, практические задания и свидетельство за 30 000 рублей единовременно или в рассрочку на четыре месяца. Рассрочка доступна только физическим лицам. Отдельно есть формат для большой команды с договорной ценой, и вот в него уже входят проверка домашних заданий, поддержка менторов и кураторов, чат-группы в телеграм со спикерами и онлайн-встречи. То есть всё живое общение вынесено в корпоративный формат, а частный студент получает запись с заданиями.
Где программа проседает
Первое: непрозрачный объём. Ни часов, ни недель, ни числа практических заданий страница не приводит. Второе: нет обратной связи в базовом тарифе, хотя эксперименты по разрушению системы это ровно та область, где чужой опыт экономит месяцы. Третье: инструментов разбирается два, оба живут в Kubernetes, и для команд, у которых нагрузка не в кластере, курс покроет только методологическую часть. Четвёртое: ни возврата денег при отказе, ни налогового вычета страница курса не упоминает.
Кому это не нужно
Курс не для тех, кто только осваивает Kubernetes: требования к подготовке школа перечисляет честно, и в них есть и Linux на уровне администратора, и чтение кода на Go или Python, и понимание сети. Не подойдёт он и командам, у которых нет ни мониторинга, ни понимания нормального состояния системы: эксперимент имеет смысл, когда есть чем измерить его последствия, иначе вы просто ломаете прод без данных.
Программа курса
1История и развитие методологии
2Основные принципы и этапы
3Категории неисправностей
4Инструмент Chaos Mesh
5Инструмент Litmus
6Практические кейсы
7Бонус: Chaos Engineering и бизнес
Чему вы научитесь
- формулировать гипотезы об устойчивом поведении системы и превращать их в проверяемые эксперименты
- различать категории неисправностей: инфраструктура, ресурсы, сеть и зависимости, приложения, люди и культура
- настраивать и запускать эксперименты в Chaos Mesh: расписания, наборы операций, сбои подов, DNS и HTTP
- работать с Litmus: порядок запуска, веб-консоль, типы проб и их тестирование
- проводить восемь типовых сценариев отказа, от удаления подов до расхождения системных часов
- собирать отдельные эксперименты в последовательность действий и планировать серию проверок
- выбирать инструмент под задачу и обосновывать выбор
- объяснять руководству эффекты методологии в терминах бизнес-целей и работать по чек-листу внедрения
Как проходит обучение
Видеоуроки по темам
Семь тем, внутри каждой от трёх до восьми уроков. Доступ к материалам сохраняется 2 года, старт в любой момент.
Практические задания
Задания входят в тариф «Видеокурс». Основная практика сосредоточена в теме с восемью кейсами, где каждый сценарий отказа отрабатывается отдельно.
Бесплатный вебинар до покупки
На странице выложен вебинар про настройку и проведение первых экспериментов Chaos Engineering. По нему можно оценить подачу и уровень до оплаты.
Свидетельство по итогам
Именное свидетельство о прохождении выдают тем, кто изучил 80% курса и участвовал в решении практик. Оно входит в состав тарифа.
Часто задаваемые вопросы
Сколько стоит курс и что входит в тариф?
Какая нужна подготовка?
Какие инструменты разбираются?
Какой документ выдают?
Проверяет ли кто-то задания?
Сколько времени займёт обучение?
Можно ли применять методологию, если у нас нет отдельной команды надёжности?
Отзывы о курсе «Тестирование отказоустойчивости систем (Chaos Engineering)»
Оставить отзыв о курсе
Расскажите, как проходило обучение: что понравилось, что нет, помог ли курс в работе. Публикуем после проверки, рекламные тексты и анонимные жалобы без подробностей не пропускаем.
Это отзывы о других программах школы Слёрм: они говорят о школе в целом, а не об этом курсе.
Все отзывы школы собраны на её странице.
