Metryki, pulpity i SLI/SLO
Przekształcaj surowe dane monitoringu w znaczące metryki i pulpity oraz definiuj Service Level Indicators i Objectives, aby mierzyć niezawodność istotną dla użytkowników.
Metryki, pulpity i SLI/SLO to bezpłatna lekcja DevOps Bootcamp na CoddyKit. To lekcja 4 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej DevOps Bootcamp, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs DevOps Bootcamp zawiera 4 lekcji w sumie.
Od danych do wniosków
Zbieranie metryk to dopiero pierwszy krok. Aby uruchamiać niezawodne systemy, trzeba przekształcać liczby w panele kontrolne i cele na poziomie usług, które odzwierciedlają rzeczywiste doświadczenia użytkowników.
Cztery złote sygnały
Google SRE zaleca obserwowanie czterech sygnałów dla każdej usługi: opóźnienia, ruchu, błędów i nasycenia. Obejmują one większość problemów widocznych dla użytkowników.
Typy metryk
Typowe rodzaje metryk: licznik tylko rośnie (liczba obsłużonych żądań), wskaźnik rośnie i maleje (wykorzystywana pamięć), a histogram grupuje wartości w przedziały (czasy obsługi żądań).
Zapytania do metryk
Bazy danych szeregów czasowych, takie jak Prometheus, używają języka zapytań do analizowania metryk. W tym przypadku obliczamy liczbę żądań na sekundę w pięciominutowym przedziale.
rate(http_requests_total[5m])Tworzenie panelu kontrolnego
Narzędzia takie jak Grafana przekształcają zapytania w panele. Dobry panel kontrolny pozwala od razu odpowiedzieć na pytanie: czy usługa działa teraz prawidłowo?
- Górny wiersz: złote sygnały
- Poniżej panele umożliwiające szczegółową analizę
- Spójny zakres czasu
Czym jest SLI?
Service Level Indicator to mierzona wartość odzwierciedlająca zadowolenie użytkowników — na przykład odsetek żądań obsłużonych szybko i pomyślnie.
sum(rate(http_requests_total{code!~"5.."}[5m]))
/
sum(rate(http_requests_total[5m]))Czym jest SLO?
Service Level Objective to cel określony dla wskaźnika SLI w danym przedziale czasu — na przykład pomyślna obsługa 99,9% żądań w ciągu 30 dni. Określa, co oznacza wystarczająco dobre działanie.
SLA a SLO
SLA to umowna obietnica składana klientom, często wiążąca się z karami. SLO to wewnętrzne, zwykle bardziej rygorystyczne cele inżynieryjne.
Budżety błędów
Jeśli SLO wynosi 99,9%, pozostałe 0,1% to budżet błędów — margines awarii, na który można sobie pozwolić. Można przeznaczyć go na ryzykowne wdrożenia, ale po jego wyczerpaniu należy zwolnić i ustabilizować system.
Alerty dotyczące objawów, nie przyczyn
Wysyłaj powiadomienia do ludzi o tym, co odczuwają użytkownicy (wysoki odsetek błędów, wolne odpowiedzi), a nie o każdym chwilowym wzroście użycia procesora. Alerty oparte na objawach ograniczają szum i zmęczenie alertami.
Unikaj nadmiaru paneli kontrolnych
Zbyt wiele paneli kontrolnych jest równie złe jak brak jakiegokolwiek. Utrzymuj niewielki zestaw zaufanych paneli, za które ktoś odpowiada i które są powiązane z SLO, zamiast dziesiątek nieaktualnych paneli.
Szybkie sprawdzenie
Jaki jest związek między SLO a budżetami błędów?
Podsumowanie
Można już nadawać monitoringowi praktyczne znaczenie:
- Obserwuj cztery złote sygnały
- Rozumiej działanie liczników, wskaźników i histogramów; używaj funkcji rate()
- Definiuj SLI (wartości mierzone) i SLO (cele)
- Budżety błędów pomagają ustalać tempo wdrożeń; wysyłaj alerty dotyczące objawów
Niezawodność staje się czymś, co można mierzyć i kształtować, a nie tylko na co liczyć.
Często zadawane pytania
Czy lekcja „Metryki, pulpity i SLI/SLO” jest bezpłatna?
Tak — pełny tekst „Metryki, pulpity i SLI/SLO” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu DevOps Bootcamp, przejdź na CoddyKit PRO. Kurs DevOps Bootcamp zawiera 4 lekcji w sumie.
Co nauczysz się w „Metryki, pulpity i SLI/SLO”?
Przekształcaj surowe dane monitoringu w znaczące metryki i pulpity oraz definiuj Service Level Indicators i Objectives, aby mierzyć niezawodność istotną dla użytkowników. Ćwiczysz DevOps Bootcamp z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.
Czy potrzebuję doświadczenia, aby zacząć DevOps Bootcamp?
Nie wymagamy żadnego doświadczenia. DevOps Bootcamp w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 4 z 4.
Ile czasu zajmuje lekcja „Metryki, pulpity i SLI/SLO”?
Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.
Czy mogę pisać i uruchamiać kod w tej lekcji DevOps Bootcamp?
Tak. Każda lekcja DevOps Bootcamp zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.
Wszystkie lekcje w tym kursie
- Wprowadzenie do monitorowania
- Scentralizowane rozwiązania do logowania
- Alerty i reagowanie na incydenty
- Metryki, pulpity i SLI/SLO