KursyObservability od zera
Observability od zera
Prometheus, PromQL, własne eksportery, Loki i Alloy — z przygotowaniem do egzaminu PCA
Program
- Po co w ogóle metryki Monitoring kontra observability, cztery złote sygnały i dlaczego zielony dashboard bywa kłamstwem. Podgląd
-
Ile dziewiątek obiecałeś? SLI, SLO i SLA, budżet błędów, tempo spalania oraz trzeci filar: ślady 🔒
-
Prometheus: target, scrape, relabeling Model pull, metryka up, relabeling i kardynalność, która potrafi położyć Prometheusa. ćwiczenie 🔒
-
Skąd Prometheus wie, kogo odpytywać file_sd, kubernetes_sd i pięć ról, etykiety __meta_*, honor_labels, cała ścieżka od SD do bazy 🔒
-
Alerty, które nie budzą o trzeciej w nocy Objawy zamiast przyczyn, parametr for, runbooki, wyciszanie zależności i testowanie reguł. ćwiczenie 🔒
-
PromQL I: naucz się mówić do bazy Typy danych, matchery etykiet, zakresy, offset, staleness i HTTP API 🔒
-
PromQL II: rate, czyli fizyka liczników Liczniki i mierniki, rate/irate/increase, resety, predict_linear i changes 🔒
-
PromQL III: agregacje i algebra wektorów Operatory agregacji, *_over_time, dopasowanie wektorów, group_left, bool, and/or/unless 🔒
-
PromQL IV: histogramy, czas i chirurgia etykiet histogram_quantile, histogramy natywne, time()/timestamp(), subquery, label_replace 🔒
-
Własny exporter: metryki z rzeczy, która ich nie ma Cztery typy metryk, format tekstowy, gotowy exporter w Pythonie na prawdziwym przykładzie sterowania pompą i pięć błędów, które zobaczysz na produkcji. ćwiczenie 🔒
-
Pushgateway: kiedy pull nie ma jak Joby wsadowe, klucz grupy, honor_labels i cztery pułapki, przez które to boli 🔒
-
Dashboard, który czyta się w pięć sekund Dobór panelu do sygnału, zmienne i powtarzanie, $__rate_interval, RED i USE 🔒
-
Loki i Alloy: logi obok metryk, w jednym miejscu Dlaczego Loki nie jest Elasticsearchem, konfiguracja Alloya do metryk i logów naraz, LogQL, skok z wykresu do logów i retencja, która naprawdę kasuje. 🔒
-
Produkcja: kiedy Prometheus zaczyna boleć Skąd bierze się pamięć, jak znaleźć metrykę zabójcę, recording rules, retencja, wysoka dostępność bez klastra i lista kontrolna przed wdrożeniem. 🔒
-
Szablony powiadomień: alert, który da się przeczytać Skąd szablon bierze dane, trzy pułapki (kropka w pętli, ciche puste pola, białe znaki) i symulator, w którym widzisz powiadomienie przed wysłaniem na produkcję. 🔒
Monitoring, który mówi prawdę — także wtedy, gdy prawda jest niewygodna.
Kurs powstał z wdrożeń, nie z dokumentacji. Każda pułapka, którą tu opisuję, kosztowała kiedyś kogoś noc: kardynalność, która położyła Prometheusa, alert odpalony punktualnie przy awarii, której nikt nie zauważył, dashboard pokazujący średnią, przez który problem był niewidoczny przez dwie godziny.
Po kursie umiesz: postawić i utrzymać Prometheusa pod prawdziwą infrastrukturą, pisać PromQL, który odpowiada na pytania zamiast produkować ładne wykresy, napisać własny exporter do rzeczy, która metryk nie ma, spiąć logi z metrykami przez Loki i Alloy oraz zbudować alerty, które budzą tylko wtedy, gdy trzeba wstać.
Przygotowuje do PCA (Prometheus Certified Associate). Program pokrywa wszystkie obszary egzaminu — najwięcej miejsca zajmuje PromQL, bo to najcięższa część i tam odpada najwięcej osób.
Dla kogo. Dla ludzi, którzy noszą pager, i dla tych, którzy dopiero zaczynają i chcą podejść do certyfikatu. Zakładam Linuksa i pojęcie o kontenerach. Nic więcej.
Jak to działa. Każda lekcja kończy się sprawdzianem — nie z definicji, tylko z roboty. Pytania są takie, jakie zadałby ktoś stojący obok przy awarii.
Czego tu nie ma. Klikania w Grafanie. Tego nauczysz się sam w godzinę.
Dostęp do kursu
120 złPełny dostęp do wszystkich 15 lekcji, ćwiczeń i sprawdzianów, bezterminowo. Płatność BLIK-iem, przelewem albo kartą — dostęp aktywuje się od razu po zaksięgowaniu.
Kup dostęp — 120 zł Mam kod — załóż konto
Dla zespołu: jeden kod na dowolną liczbę miejsc — rozdajesz go ludziom, zamiast zakładać konta za nich. Napisz na kursy@aurora-tech.pl, ilu osób dotyczy.