Интенсив по погружению в SRE
Онлайн-интенсив учебного центра Слёрм по Site Reliability Engineering в формате телеграм-чата. Расписание жёсткое: 7 учебных дней в течение двух недель, старт потока 21 сентября 2026, завершение 2 октября, с перерывом на выходные для отстающих. Практика идёт без технического стенда: вы выбираете знакомый сервис и на его примере собираете SRE-пакет из 11 блоков (описание сервиса и пользовательское обещание, SLI, SLO и error budget, таблица golden signals с условиями алертинга, план первых 15 минут инцидента, mini-postmortem с таймлайном и action items, кандидаты на автоматизацию из toil, личный roadmap на 3 месяца). День состоит из материалов на 35 минут, авторского видео или подкаста на 10-15 минут, задания на мышление на 20-40 минут, теста из 5-7 вопросов и открытого вопроса для дискуссии. Автор один: Максим Гусев, руководитель команды SRE в RWB, более 11 лет в отказоустойчивых системах, прошёл путь до техлида SRE в финтехе и Lead Observability Team в Dodo Engineering. Документ: свидетельство о прохождении по запросу. Цена 5 000 рублей, оплаченная сумма засчитывается в стоимость большого SRE-курса.
Мнение редакции
Самый необычный курс в линейке школы: технический учебный центр выпустил программу, в которой намеренно нет ни строчки кода. Не потому, что аудитория слабая, а потому что предмет другой. SRE это в первую очередь способ смотреть на сервис, и главный барьер здесь не в том, чтобы настроить Prometheus, а в том, чтобы ответить на вопрос, что для пользователя значит «сервис работает». Интенсив ставит именно этот вопрос первым и дальше разворачивает из него всё остальное: показатели, цели, бюджет ошибок, сигналы, реакцию на аварию, разбор после неё.
Практика устроена умно. Вы берёте сервис, который знаете, и делаете на нём семь артефактов подряд. Не абстрактные упражнения, а документы, которые в реальной команде кто-то должен написать и обычно не пишет: пользовательское обещание, таблица golden signals с условиями алертинга, план первых пятнадцати минут инцидента, mini-postmortem с таймлайном и action items, список toil-кандидатов на автоматизацию. К концу у вас на руках папка, которую можно принести на работу и обсуждать предметно, а не пересказывать, что вы что-то слушали.
Границы обозначены на удивление честно, и это редкость. Прямо в шапке написано: без кода, Kubernetes и настройки окружения. Отдельным блоком: за неделю вы не станете SRE, зато поймёте, как SRE смотрит на сервис. И две ссылки на большой курс, для тех, кому нужны стенды и командные инциденты. Более того, 5 000 рублей за интенсив школа обещает зачесть в стоимость большой программы, то есть формат прямо продаётся как разведка.
Что не сходится. На странице одновременно написано, что для участия понадобится до четырёх часов в день, и что дневная нагрузка составляет примерно 100-120 минут. Разница вдвое, и планировать по такой вилке неудобно. Второе: свидетельство выдаётся «по запросу», а не автоматически, и об этом сказано одной строкой в разделе вопросов.
Плюсы
- цена 5 000 рублей засчитывается в стоимость большого SRE-курса школы, то есть интенсив можно брать как разведку без потери денег
- на выходе остаётся не конспект, а рабочий артефакт: SRE-пакет из 11 блоков по вашему собственному сервису
- никаких требований к инфраструктуре: не нужны код, кластер, доступ к продакшену и установка инструментов, достаточно телеграма и браузера
- автор это действующий руководитель команды SRE с опытом Dodo Engineering и финтеха, а весь интенсив держит одну терминологию
- школа честно очерчивает границы: прямо написано, что за неделю вы не станете SRE, и дважды отправляет тех, кому нужна глубина, на большой курс
- расписание расписано по датам вплоть до дня, с выходными на догон отстающих
Минусы
- страница противоречит сама себе по нагрузке: в требованиях названо до четырёх часов в день, а в разделе вопросов около 100-120 минут
- свидетельство о прохождении выдаётся только по запросу, автоматически документ не приходит
- обратная связь заявлена как групповая: персонального разбора вашего SRE-пакета школа не обещает
- инструментов нет вообще: SLO вы сформулируете, но настраивать их в Prometheus, собирать алерты и дежурить будете учиться отдельно
Кому подходит
Тем, кто присматривается к SRE
Школа адресует интенсив тем, кто работает или учится в IT и хочет понять, как SRE смотрит на надёжность сервисов и стоит ли двигаться в эту сторону. Финальный день целиком посвящён карте навыков и точкам входа.
DevOps- и системным инженерам, у которых знания разрозненны
Отдельный блок описывает знакомую ситуацию: инфраструктура уже знакома, а SLO, error budget, инцидент-менеджмент и postmortem пока не сложились в единую систему.
Разработчикам, которые отвечают за сервис после релиза
Для них интенсив это словарь и рамка: понимать, что происходит после деплоя, и говорить с SRE-командой на одном языке.
Кому курс не подойдёт
- действующим SRE: страница сама отправляет их на большой практический курс со стендами и командными инцидентами
- тем, кому нужны инструменты: ни Prometheus, ни Grafana, ни Kubernetes здесь не настраиваются, практика идёт без технического стенда
- тем, кто не готов держать поток: интенсив идёт по расписанию с 21 сентября по 2 октября, а обратная связь живёт в общем чате
Чем отличается от других курсов направления
Соседей по направлению у интенсива всего двое, и оба тяжелее на порядок: «Управление надёжностью систем на основе данных» той же школы за 60 000 рублей и «SRE инженер» TeachMeSkills за 130 000 рублей на восемь месяцев. Разница не в глубине изложения, а в жанре. Большие программы учат работать: стенды, кластеры, аварии, восстановление сервиса. Этот интенсив учит думать и специально лишён инструментов, чтобы за семь дней успеть пройти всю рамку целиком, от пользовательского обещания до postmortem. Отсюда и цена в десятки раз ниже. Отдельно стоит отметить экономику решения: 5 000 рублей за интенсив школа обещает зачесть в стоимость большого курса, поэтому для человека, который колеблется между «мне это интересно» и «мне это подходит», порядок действий очевиден. И ещё одно отличие от почти всех курсов рынка: результат здесь материальный. Не сертификат и не конспект, а собранный своими руками SRE-пакет по реальному сервису, с которым можно прийти к своему тимлиду.
Обзор курса
Кто стоит за курсом
Автор и спикер один: Максим Гусев, руководитель команды SRE в RWB. Больше 11 лет строит отказоустойчивые системы, прошёл путь от инженера, который менял бумагу в принтере, до техлида SRE в финтехе и руководителя команды observability в Dodo Engineering. В описании отдельно сказано, чем он занимается по убеждению: искоренением toil и построением нормального инцидент-менеджмента. Для семидневного формата, где каждый день это авторское видео и разбор в чате, единственный автор оправдан: интенсив держит одну методическую линию и одну терминологию.
Как устроена нагрузка
Семь учебных дней, растянутых на две недели с 21 сентября по 2 октября: старт и знакомство, нулевой день с объяснением правил, затем по одному учебному дню, выходные для отстающих, затем ещё четыре дня и завершение потока со сбором обратной связи и дополнительными материалами. Структура дня одинаковая: статьи и скринкасты примерно на 35 минут, авторское видео или подкаст на 10-15 минут, задание на мышление на 20-40 минут, тест из 5-7 вопросов и открытый вопрос для дискуссии в чате. По этой раскладке выходит около двух часов, хотя в требованиях к участию названо до четырёх часов в день.
Что входит в стоимость
За 5 000 рублей: полезные материалы с бессрочным доступом, скринкасты, ежедневные задания с групповой обратной связью от спикера в чате и итоговый SRE-пакет по выбранному сервису как первый артефакт для портфолио. Тарифов нет, доплат нет. Отдельная и редкая опция: сумма засчитывается в стоимость большого SRE-курса, если вы решите продолжить.
Что вы соберёте
SRE-пакет из 11 блоков по одному знакомому сервису. День за днём: описание сервиса и пользовательское обещание, затем SLI, SLO и error budget, затем таблица четырёх golden signals с условиями алертинга, затем план первых 15 минут инцидента с impact, severity, mitigation, ролями и коммуникацией, затем mini-postmortem с таймлайном и action items в культуре без поиска виноватых, затем разбор toil и кандидатов на автоматизацию с ответом на вопрос, когда runbook это временное решение, и наконец личный roadmap на три месяца с картой навыков и карьерными точками входа из смежных ролей.
Где программа проседает
Первое: противоречие в оценке нагрузки, до четырёх часов в день против ста двадцати минут. Второе: свидетельство только по запросу, что стоит держать в голове тем, кто собирает документы для работодателя. Третье: отсутствие инструментов это осознанный выбор, но он же ограничивает применимость. Вы научитесь формулировать SLO, но не настраивать их в Prometheus, опишете сигналы, но не соберёте алерты, распишете реакцию на инцидент, но не проживёте её на стенде. Четвёртое: формат потоковый и короткий, пропустив пару дней, вы выпадаете из общей дискуссии, а именно она здесь заменяет проверку заданий: обратная связь названа групповой, то есть персонального разбора вашего пакета не обещано.
Кому это не нужно
Действующим SRE: страница сама отправляет их на большой курс. Тем, кому нужны Kubernetes, код, учебный кластер и командные инциденты, там же. И тем, кто ждёт от курса инструмента: здесь дают язык и рамку, а инструменты придётся осваивать отдельно.
Программа курса
1День 1. Кто такой SRE и зачем он бизнесу
2День 2. SLI, SLO, SLA и error budget
3День 3. Мониторинг и observability
4День 4. Инциденты и дежурства
5День 5. Postmortem без поиска виноватых
6День 6. Toil, runbook и автоматизация
7День 7. Roadmap в профессию
Чему вы научитесь
- формулировать пользовательское обещание сервиса и объяснять, что для пользователя значит «работает»
- переводить надёжность в цифры: строить SLI, ставить SLO и считать error budget
- разбираться в связке SLI, SLO, SLA, error budget, golden signals, toil и postmortem и объяснять её коллегам
- отличать полезный алерт от шумного и составлять таблицу сигналов с условиями алертинга
- описывать структуру реакции на инцидент: impact, severity, mitigation, роли и коммуникация в первые 15 минут
- писать postmortem без поиска виноватых, с таймлайном и работающими action items
- находить toil и решать, когда достаточно runbook, а когда нужна автоматизация
- строить личный roadmap развития в SRE на ближайшие месяцы
Как проходит обучение
Онлайн-интенсив в телеграм-чате
Вся программа живёт в чате: материалы, авторские видео, задания и дискуссии. Для участия понадобятся только телеграм, браузер и любое приложение для заметок.
Структура дня из пяти частей
Статьи и скринкасты примерно на 35 минут, авторское видео или подкаст на 10-15 минут, задание на мышление на 20-40 минут, тест из 5-7 вопросов и открытый вопрос для дискуссии.
Практика без кода и стендов
Вы выбираете знакомый сервис и на его примере составляете все артефакты: SLI и SLO, error budget, сигналы мониторинга, план реакции на инцидент, mini-postmortem и карьерный план.
Расписание на две недели
Семь учебных дней с 21 сентября по 2 октября, с перерывом на выходные, чтобы отстающие догнали материал. Завершение потока со сбором обратной связи и выдачей дополнительных материалов.
Групповая обратная связь от спикера
Задания разбираются в общем чате: школа обещает ежедневную групповую обратную связь от автора, а не персональное ревью каждого пакета.
Часто задаваемые вопросы
Нужен ли опыт в SRE или DevOps?
Нужно ли писать код или ставить инструменты?
Сколько времени нужно в день?
Что останется после интенсива?
Выдают ли документ?
Когда идёт поток?
Стоит ли идти, если я уже работаю с надёжностью?
Отзывы о курсе «Интенсив по погружению в SRE»
Оставить отзыв о курсе
Расскажите, как проходило обучение: что понравилось, что нет, помог ли курс в работе. Публикуем после проверки, рекламные тексты и анонимные жалобы без подробностей не пропускаем.
Это отзывы о других программах школы Слёрм: они говорят о школе в целом, а не об этом курсе.
Все отзывы школы собраны на её странице.
