Мониторинг в Grafana
Курс учебного центра Слёрм по мониторингу в Grafana в связке с Prometheus. Объём: 8 модулей, 6 часов теории и 17 часов практики, доля практики 74%, доступ к материалам 2 года. Программа: подходы к мониторингу, blackbox и whitebox, четыре золотых сигнала, методики RED и USE, установка и базовая настройка Grafana, Prometheus и Alertmanager, модель данных и типы метрик с особенностями мониторинга задержек, базовые функции PromQL, создание первого дашборда, продвинутая работа с дашбордами через explorer, инспектор запросов, переменные и ссылки на данные, алертинг в Grafana и Prometheus со сравнением подходов и отдельный модуль про тестирование алертов. Необходимые навыки: работа с Docker и docker-compose, чтение кода на Go. Спикер: Сергей Бухаров, руководитель процесса надёжности в Dodo Engineering, спикер конференций HighLoad, DevOps Live, DevOops и Podlodka Crew. Документ: именное свидетельство при 80% прохождения. Цена в каталоге: 30 000 рублей, в рассрочку от 7 500 рублей в месяц, тогда как на странице школы видеокурс стоит 18 900 рублей единовременно или 4 725 рублей в месяц на четыре месяца.
Мнение редакции
Курсов по Grafana много, и почти все они про кнопки: где нажать, чтобы получился график. Этот курс начинается с другого конца, с подходов. Первый модуль разбирает blackbox и whitebox, четыре золотых сигнала, методики RED и USE, и только после этого идёт установка. Такой порядок правильный: без него дашборд получается красивым и бесполезным, а алерты начинают шуметь на второй неделе.
Второе, что выделяет программу, это восьмой модуль про тестирование алертов. Тесты на правила алертинга пишут единицы команд, и на курсах эту тему обычно не поднимают вообще. Здесь ей отведён отдельный модуль с разбором того, зачем тесты нужны, как их писать, как интерпретировать результат и какие у них недостатки. Для инженера, который дежурит, это самая практичная часть курса.
Ограничения стандартные для формата: разбора работ человеком нет, вопросы задавать некому. Плюс расхождение по цене: в каталоге курс стоит 30 000 рублей, а на странице школы 18 900 рублей, то есть примерно в полтора раза дешевле, и сумму стоит сверить до оплаты. И небольшая небрежность: одна из форм заявки на странице подписана названием совсем другого курса школы, про мониторинг и логирование инфраструктуры в Kubernetes.
Плюсы
- курс начинается не с интерфейса, а с подходов: blackbox и whitebox, четыре золотых сигнала, методики RED и USE
- отдельный модуль про тестирование алертов, тему, которую на курсах обычно не поднимают вообще
- три четверти времени отдано практике: 17 часов заданий против 6 часов теории
- алертинг разбирается сразу в двух системах, в Grafana и в Prometheus, со сравнением преимуществ и недостатков каждой
- каждый модуль заканчивается сформулированным результатом, поэтому заранее видно, что именно вы будете уметь
- спикер отвечает за процесс надёжности в крупной продуктовой компании и выступает на профильных конференциях
Минусы
- цена в каталоге примерно в полтора раза выше цены на сайте: в фиде 30 000 рублей против 18 900 рублей на странице школы
- обратной связи нет: тариф включает видеоуроки и задания, разбор дашбордов и правил алертинга человеком не обещан
- требование читать код на Go названо без пояснений и может отпугнуть тех, кому оно на курсе почти не понадобится
- одна из форм заявки на странице подписана названием другого курса школы, про мониторинг и логирование инфраструктуры в Kubernetes
Кому подходит
Системным администраторам, которые обслуживают инфраструктуру
Школа называет эту группу первой: им нужны навыки мониторинга для более стабильной работы системы. Курс даёт и подходы, и готовую связку инструментов.
Разработчикам, которые сами отвечают за мониторинг своего сервиса
Формулировка со страницы: научиться самостоятельно выбирать и настраивать метрики стабильности без траты времени на чтение документации и остановки работы над новыми функциями.
Инженерам по автоматизации, которым нужно глубже понимать процессы мониторинга
Третья названная группа. Для них отдельная ценность в модулях про типы метрик и PromQL: на них строится и оптимизация загрузки кластера, и настройка балансировщиков по метрикам.
Тем, кто устал от шумящих алертов
Один из заявленных результатов курса это настройка алертов без ложных срабатываний и уход от постоянного режима реагирования. Модули про алертинг и его тестирование посвящены ровно этому.
Кому курс не подойдёт
- командам, у которых уже настроена связка Prometheus и Grafana с продуманными правилами: курс про построение системы с нуля и правильно
- тем, кому нужна наблюдаемость целиком: трассировок и логов в программе нет, они вынесены в отдельный курс школы
- новичкам без Docker: школа прямо называет умение работать с Docker и docker-compose среди необходимых навыков
Чем отличается от других курсов направления
В каталоге курс лежит в направлении «Программирование», где соседями оказались программы про нейросети и вайбкодинг, то есть сравнивать по направлению не с чем. Внутри линейки Слёрма это средняя ступень наблюдаемости: легаси-запись 2019 года про Prometheus дешевле и старше, «Мониторинг и логирование инфраструктуры в Kubernetes» за 60 000 рублей шире и привязан к кластеру, а комплект с интенсивом «Наблюдаемость надёжных систем» за 25 520 рублей вместо 31 900 добавляет к метрикам вторую половину темы. Отличие этого курса от соседей в фокусе: связка Prometheus и Grafana разобрана от выбора метрик до тестов на алерты и без привязки к оркестратору.
Обзор курса
Кто стоит за курсом
Спикер один: Сергей Бухаров, руководитель процесса надёжности в Dodo Engineering. Карьеру начинал разработчиком на .NET и Node.js, занимается внедрением культуры надёжности в компании, выступает на конференциях HighLoad, DevOps Live, DevOops и Podlodka Crew, записи докладов есть в открытом доступе. Профиль объясняет структуру курса: человек, который отвечает не за график, а за то, чтобы команда узнавала о проблеме раньше пользователей, начинает не с интерфейса, а с выбора метрик.
Как устроена нагрузка
Формат самостоятельный: видеоуроки и практические задания, старт в любой момент, доступ к материалам 2 года. Объём небольшой и честно назван: 6 часов теории и 17 часов практики на восемь модулей, три четверти времени приходится на практику. Каждый модуль заканчивается формулировкой результата, то есть заранее понятно, что именно вы будете уметь после него.
Что входит в стоимость
Тариф на странице один: видеоуроки и практические задания за 18 900 рублей единовременно или 4 725 рублей в месяц на четыре месяца, рассрочка только для физических лиц. Отдельно продаётся комплект с записью интенсива «Наблюдаемость надёжных систем»: вместе 25 520 рублей вместо 31 900, для юридических лиц 48 000 вместо 60 000. Второй курс адресован инженерам надёжности и логично продолжает первый: мониторинг отвечает на вопрос что сломалось, наблюдаемость на вопрос почему.
Где программа проседает
Первое: цена в каталоге примерно в полтора раза выше цены на сайте, и другого тарифа, который бы это объяснил, страница не показывает. Второе: нет обратной связи, а мониторинг та область, где полезнее всего было бы показать свой дашборд человеку, который видел сотни чужих. Третье: требования названы коротко и без пояснений, работать с Docker и docker-compose, читать код на Go, и последний пункт может отпугнуть зря, потому что писать на Go на курсе не нужно. Четвёртое: на странице встречается форма заявки, подписанная названием другого курса школы, что выглядит как остаток чужого блока.
Кому это не нужно
Инженерам, у которых уже стоит связка Prometheus и Grafana с продуманными правилами алертинга, курс даст мало: он про то, как построить систему мониторинга правильно с первого раза. Не подойдёт он и тем, кто ищет наблюдаемость целиком: трассировки и логов здесь нет, за ними школа отправляет в соседний курс.
Программа курса
1Подходы к мониторингу
2Установка и настройка
3Prometheus: модель данных и типы метрик
4PromQL
5Grafana: первый дашборд
6Grafana: продвинутая работа
7Алертинг: Grafana против Prometheus
8Тестирование алертов
Чему вы научитесь
- выбирать подход к мониторингу под конкретный сервис, опираясь на золотые сигналы, RED и USE
- устанавливать и базово настраивать Grafana, Prometheus и Alertmanager
- различать типы метрик Prometheus и корректно измерять задержки
- писать запросы на PromQL и работать с метриками в динамике
- строить дашборды и доводить их до уровня инструмента расследования через переменные, explorer и инспектор запросов
- настраивать алерты в Grafana и в Prometheus и обосновывать выбор между ними
- писать тесты на правила алертинга и интерпретировать их результаты
- находить причину инцидента по метрикам и видеть проблему до жалоб пользователей
Как проходит обучение
Видеоуроки по модулям
8 модулей, 6 часов теории. Каждый модуль заканчивается сформулированным результатом обучения, доступ к материалам 2 года.
Практические задания
17 часов практики, три четверти всего курса. Практика идёт на разворачиваемой в начале курса связке Grafana, Prometheus и Alertmanager.
Старт в любой момент
Потока ждать не нужно, обучение начинается когда удобно, темп задаёт студент. Учиться можно в комфортном темпе, как формулирует сама школа.
Демодоступ на три дня
До покупки школа открывает демодоступ в LMS на три дня: посмотреть материалы и познакомиться со спикером.
Часто задаваемые вопросы
Сколько стоит курс?
Что нужно уметь до старта?
Разбирается ли Prometheus или только Grafana?
Какой документ выдают?
Сколько времени займёт обучение?
Есть ли проверка заданий?
Стоит ли брать комплект с курсом про наблюдаемость?
Отзывы о курсе «Мониторинг в Grafana»
Оставить отзыв о курсе
Расскажите, как проходило обучение: что понравилось, что нет, помог ли курс в работе. Публикуем после проверки, рекламные тексты и анонимные жалобы без подробностей не пропускаем.
Это отзывы о других программах школы Слёрм: они говорят о школе в целом, а не об этом курсе.
Все отзывы школы собраны на её странице.
