0Pricing
DevOps Bootcamp · Lektion

Metriken, Dashboards und SLIs/SLOs

Verwandeln Sie rohe Monitoringdaten in aussagekräftige Metriken und Dashboards und definieren Sie Service Level Indicators und Objectives, um die für Nutzer relevante Zuverlässigkeit zu messen.

Metriken, Dashboards und SLIs/SLOs ist eine kostenlose DevOps Bootcamp-Lektion auf CoddyKit. Dies ist Lektion 4 von 4. Du kannst die komplette Lektion unten kostenlos lesen – dann übst du sie direkt im Browser mit einem integrierten Code-Editor und einem KI-Tutor rund um die Uhr. Sie ist Teil des DevOps Bootcamp-Lernpfads, und dein Fortschritt wird über Web und CoddyKit-App synchronisiert. Der DevOps Bootcamp-Kurs umfasst insgesamt 4 Lektionen.

Von Daten zu Erkenntnissen

Metriken zu sammeln ist nur der erste Schritt. Für den zuverlässigen Betrieb von Systemen müssen Sie Zahlen in Dashboards und Service-Level-Ziele übersetzen, die die tatsächliche Nutzererfahrung widerspiegeln.

Die vier goldenen Signale

Google SRE empfiehlt, für jeden Service vier Signale zu beobachten: Latenz, Traffic, Fehler und Sättigung. Sie decken die meisten nutzerseitigen Probleme ab.

Metriktypen

Häufige Formen von Metriken: Ein Counter steigt nur an (verarbeitete Anfragen), ein Gauge steigt und fällt (belegter Speicher), und ein Histogramm gruppiert Werte in Klassen (Anfragedauern).

Metriken abfragen

Zeitreihendatenbanken wie Prometheus verwenden eine Abfragesprache, um Metriken zu analysieren. Hier berechnen wir die Anfragerate pro Sekunde über einen Zeitraum von fünf Minuten.

rate(http_requests_total[5m])

Ein Dashboard erstellen

Tools wie Grafana wandeln Abfragen in Panels um. Ein gutes Dashboard beantwortet eine Frage auf einen Blick: Ist der Service gerade gesund?

  • Obere Zeile: goldene Signale
  • Darunter Panels für die Detailanalyse
  • Einheitlicher Zeitraum

Was ist ein SLI?

Ein Service-Level-Indikator ist eine gemessene Kennzahl, die die Nutzererfahrung widerspiegelt – beispielsweise der Anteil der Anfragen, die erfolgreich und schnell verarbeitet werden.

sum(rate(http_requests_total{code!~"5.."}[5m]))
 /
sum(rate(http_requests_total[5m]))

Was ist ein SLO?

Ein Service-Level-Ziel ist ein Zielwert für einen SLI über einen bestimmten Zeitraum – zum Beispiel, dass innerhalb von 30 Tagen 99,9 % der Anfragen erfolgreich sind. Es definiert, was ausreichend gut bedeutet.

SLA im Vergleich zu SLO

Ein SLA ist ein vertragliches Versprechen gegenüber Kunden, das häufig mit Vertragsstrafen verbunden ist. SLOs sind Ihre internen, normalerweise strengeren Ziele für die Entwicklung und den Betrieb.

Fehlerbudgets

Wenn Ihr SLO bei 99,9 % liegt, sind die verbleibenden 0,1 % Ihr Fehlerbudget – der Ausfall, den Sie sich leisten können. Setzen Sie es für risikoreiche Deployments ein; wenn es aufgebraucht ist, verlangsamen Sie sich und stabilisieren Sie das System.

Bei Symptomen alarmieren, nicht bei Ursachen

Lösen Sie für das, was Benutzer spüren, einen Alarm für Menschen aus (hohe Fehlerrate, langsame Antworten), nicht für jede kurze CPU-Schwankung. Symptom-basierte Alarme verringern Rauschen und Alarmmüdigkeit.

Dashboard-Wildwuchs vermeiden

Zu viele Dashboards sind genauso problematisch wie gar keine. Beschränken Sie sich auf eine kleine Auswahl verlässlicher Dashboards, für die Verantwortliche feststehen und die an Ihre SLOs gebunden sind, statt Dutzende veraltete Dashboards zu pflegen.

Kurzer Test

Wie hängen SLOs und Fehlerbudgets zusammen?

Zusammenfassung

Sie können Monitoring jetzt sinnvoll gestalten:

  • Beobachten Sie die vier goldenen Signale
  • Verstehen Sie Counter, Gauges und Histogramme; fragen Sie sie mit rate() ab
  • Definieren Sie SLIs (Messwerte) und SLOs (Zielwerte)
  • Fehlerbudgets geben das Tempo von Deployments vor; alarmieren Sie bei Symptomen

Zuverlässigkeit wird zu etwas, das Sie messen und steuern, statt nur darauf zu hoffen.

Häufig gestellte Fragen

Ist die Lektion „Metriken, Dashboards und SLIs/SLOs“ kostenlos?

Ja — der vollständige Text von „Metriken, Dashboards und SLIs/SLOs“ ist hier im Web kostenlos zu lesen. Um sie interaktiv zu üben (integrierter Code-Editor und 24/7 KI-Tutor) und den Rest des DevOps Bootcamp-Kurses freizuschalten, upgrade auf CoddyKit PRO. Der DevOps Bootcamp-Kurs umfasst insgesamt 4 Lektionen.

Was lerne ich in „Metriken, Dashboards und SLIs/SLOs“?

Verwandeln Sie rohe Monitoringdaten in aussagekräftige Metriken und Dashboards und definieren Sie Service Level Indicators und Objectives, um die für Nutzer relevante Zuverlässigkeit zu messen. Du übst DevOps Bootcamp mit praktischem Code, den du direkt im Browser ausführst, und ein 24/7 KI-Tutor beantwortet deine Fragen während du die Lektion bearbeitest.

Brauche ich Erfahrung, um DevOps Bootcamp zu starten?

Keine Vorkenntnisse erforderlich. DevOps Bootcamp auf CoddyKit ist für Anfänger bis fortgeschrittene Lernende strukturiert, sodass du hier starten oder von Anfang an beginnen und in deinem eigenen Tempo voranschreiten kannst. Dies ist Lektion 4 von 4.

Wie lange dauert die Lektion „Metriken, Dashboards und SLIs/SLOs“?

Die meisten CoddyKit-Lektionen dauern etwa 5–10 Minuten. Jede ist kompakt und interaktiv, sodass du stetig Fortschritte machst und genau dort weitermachst, wo du aufgehört hast – im Web und in der App.

Kann ich in dieser DevOps Bootcamp-Lektion Code schreiben und ausführen?

Ja. Jede DevOps Bootcamp-Lektion enthält einen integrierten Code-Editor, sodass du echten Code direkt in deinem Browser schreibst und ausführst und sofort KI-Feedback erhältst — ohne lokale Einrichtung erforderlich.

Alle Lektionen in diesem Kurs

  1. Einführung in das Monitoring
  2. Zentralisierte Logging-Lösungen
  3. Alerting und Incident Response
  4. Metriken, Dashboards und SLIs/SLOs
← Zurück zu DevOps Bootcamp