Metriken, Dashboards und SLIs/SLOs
Verwandeln Sie rohe Monitoringdaten in aussagekräftige Metriken und Dashboards und definieren Sie Service Level Indicators und Objectives, um die für Nutzer relevante Zuverlässigkeit zu messen.
Metriken, Dashboards und SLIs/SLOs ist eine kostenlose DevOps Bootcamp-Lektion auf CoddyKit. Dies ist Lektion 4 von 4. Du kannst die komplette Lektion unten kostenlos lesen – dann übst du sie direkt im Browser mit einem integrierten Code-Editor und einem KI-Tutor rund um die Uhr. Sie ist Teil des DevOps Bootcamp-Lernpfads, und dein Fortschritt wird über Web und CoddyKit-App synchronisiert. Der DevOps Bootcamp-Kurs umfasst insgesamt 4 Lektionen.
Von Daten zu Erkenntnissen
Metriken zu sammeln ist nur der erste Schritt. Für den zuverlässigen Betrieb von Systemen müssen Sie Zahlen in Dashboards und Service-Level-Ziele übersetzen, die die tatsächliche Nutzererfahrung widerspiegeln.
Die vier goldenen Signale
Google SRE empfiehlt, für jeden Service vier Signale zu beobachten: Latenz, Traffic, Fehler und Sättigung. Sie decken die meisten nutzerseitigen Probleme ab.
Metriktypen
Häufige Formen von Metriken: Ein Counter steigt nur an (verarbeitete Anfragen), ein Gauge steigt und fällt (belegter Speicher), und ein Histogramm gruppiert Werte in Klassen (Anfragedauern).
Metriken abfragen
Zeitreihendatenbanken wie Prometheus verwenden eine Abfragesprache, um Metriken zu analysieren. Hier berechnen wir die Anfragerate pro Sekunde über einen Zeitraum von fünf Minuten.
rate(http_requests_total[5m])Ein Dashboard erstellen
Tools wie Grafana wandeln Abfragen in Panels um. Ein gutes Dashboard beantwortet eine Frage auf einen Blick: Ist der Service gerade gesund?
- Obere Zeile: goldene Signale
- Darunter Panels für die Detailanalyse
- Einheitlicher Zeitraum
Was ist ein SLI?
Ein Service-Level-Indikator ist eine gemessene Kennzahl, die die Nutzererfahrung widerspiegelt – beispielsweise der Anteil der Anfragen, die erfolgreich und schnell verarbeitet werden.
sum(rate(http_requests_total{code!~"5.."}[5m]))
/
sum(rate(http_requests_total[5m]))Was ist ein SLO?
Ein Service-Level-Ziel ist ein Zielwert für einen SLI über einen bestimmten Zeitraum – zum Beispiel, dass innerhalb von 30 Tagen 99,9 % der Anfragen erfolgreich sind. Es definiert, was ausreichend gut bedeutet.
SLA im Vergleich zu SLO
Ein SLA ist ein vertragliches Versprechen gegenüber Kunden, das häufig mit Vertragsstrafen verbunden ist. SLOs sind Ihre internen, normalerweise strengeren Ziele für die Entwicklung und den Betrieb.
Fehlerbudgets
Wenn Ihr SLO bei 99,9 % liegt, sind die verbleibenden 0,1 % Ihr Fehlerbudget – der Ausfall, den Sie sich leisten können. Setzen Sie es für risikoreiche Deployments ein; wenn es aufgebraucht ist, verlangsamen Sie sich und stabilisieren Sie das System.
Bei Symptomen alarmieren, nicht bei Ursachen
Lösen Sie für das, was Benutzer spüren, einen Alarm für Menschen aus (hohe Fehlerrate, langsame Antworten), nicht für jede kurze CPU-Schwankung. Symptom-basierte Alarme verringern Rauschen und Alarmmüdigkeit.
Dashboard-Wildwuchs vermeiden
Zu viele Dashboards sind genauso problematisch wie gar keine. Beschränken Sie sich auf eine kleine Auswahl verlässlicher Dashboards, für die Verantwortliche feststehen und die an Ihre SLOs gebunden sind, statt Dutzende veraltete Dashboards zu pflegen.
Kurzer Test
Wie hängen SLOs und Fehlerbudgets zusammen?
Zusammenfassung
Sie können Monitoring jetzt sinnvoll gestalten:
- Beobachten Sie die vier goldenen Signale
- Verstehen Sie Counter, Gauges und Histogramme; fragen Sie sie mit rate() ab
- Definieren Sie SLIs (Messwerte) und SLOs (Zielwerte)
- Fehlerbudgets geben das Tempo von Deployments vor; alarmieren Sie bei Symptomen
Zuverlässigkeit wird zu etwas, das Sie messen und steuern, statt nur darauf zu hoffen.
Häufig gestellte Fragen
Ist die Lektion „Metriken, Dashboards und SLIs/SLOs“ kostenlos?
Ja — der vollständige Text von „Metriken, Dashboards und SLIs/SLOs“ ist hier im Web kostenlos zu lesen. Um sie interaktiv zu üben (integrierter Code-Editor und 24/7 KI-Tutor) und den Rest des DevOps Bootcamp-Kurses freizuschalten, upgrade auf CoddyKit PRO. Der DevOps Bootcamp-Kurs umfasst insgesamt 4 Lektionen.
Was lerne ich in „Metriken, Dashboards und SLIs/SLOs“?
Verwandeln Sie rohe Monitoringdaten in aussagekräftige Metriken und Dashboards und definieren Sie Service Level Indicators und Objectives, um die für Nutzer relevante Zuverlässigkeit zu messen. Du übst DevOps Bootcamp mit praktischem Code, den du direkt im Browser ausführst, und ein 24/7 KI-Tutor beantwortet deine Fragen während du die Lektion bearbeitest.
Brauche ich Erfahrung, um DevOps Bootcamp zu starten?
Keine Vorkenntnisse erforderlich. DevOps Bootcamp auf CoddyKit ist für Anfänger bis fortgeschrittene Lernende strukturiert, sodass du hier starten oder von Anfang an beginnen und in deinem eigenen Tempo voranschreiten kannst. Dies ist Lektion 4 von 4.
Wie lange dauert die Lektion „Metriken, Dashboards und SLIs/SLOs“?
Die meisten CoddyKit-Lektionen dauern etwa 5–10 Minuten. Jede ist kompakt und interaktiv, sodass du stetig Fortschritte machst und genau dort weitermachst, wo du aufgehört hast – im Web und in der App.
Kann ich in dieser DevOps Bootcamp-Lektion Code schreiben und ausführen?
Ja. Jede DevOps Bootcamp-Lektion enthält einen integrierten Code-Editor, sodass du echten Code direkt in deinem Browser schreibst und ausführst und sofort KI-Feedback erhältst — ohne lokale Einrichtung erforderlich.
Alle Lektionen in diesem Kurs
- Einführung in das Monitoring
- Zentralisierte Logging-Lösungen
- Alerting und Incident Response
- Metriken, Dashboards und SLIs/SLOs